diff --git a/.gitattributes b/.gitattributes index f24958422a33935e4d3cb403a98187d098a3e3d7..d12abee533a836023b0d099484f0d5b8e47fce48 100644 --- a/.gitattributes +++ b/.gitattributes @@ -38,3 +38,5 @@ qwen35-08b-fp32-8k-token-major-home/tokenizer/tokenizer.json filter=lfs diff=lfs qwen35-08b-fp32-int8-g32-home-token-major-v2/graph.json filter=lfs diff=lfs merge=lfs -text qwen35-08b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text qwen35-2b-fp32-int8-g32-home-token-major-v2/graph.json filter=lfs diff=lfs merge=lfs -text +qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer.json filter=lfs diff=lfs merge=lfs -text +qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/graph.json filter=lfs diff=lfs merge=lfs -text diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8a51207a37a0e52b47144cddccc479dbb2363614 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 49152u; +if (i >= 49152u) { return; } +let coord = (i / 1u) % 8u; +if (coord >= 0u && coord < 4u) { out[i] = f32(b0[(i / 8u) * 4u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 4u && coord < 8u) { out[i] = f32(b1[(i / 8u) * 4u + (coord - 4u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..03d07fa428a8b82cd684f25b34ee4bb8835c33e0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 131072u + ((i / 4096u) % 8u) * 16384u + ((i / 64u) % 64u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4f27100b1e707c866f7cdd701f722bed2969be6e71245d4e4a14e1ef7ebe3fcf.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4f27100b1e707c866f7cdd701f722bed2969be6e71245d4e4a14e1ef7ebe3fcf.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d5a19434a45eee25f6d04502544c62118c4e993c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4f27100b1e707c866f7cdd701f722bed2969be6e71245d4e4a14e1ef7ebe3fcf.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 131072 || token >= 163840) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 131072) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c81e589abef0fba31bf1517192cc0be68ca566c6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[((i / 131072u) % 1u) * 131072u + ((i / 2048u) % 64u) * 256u + ((i / 256u) % 8u) * 16384u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..83c89e6b3a228b3203eb756839b56f1ff744d6b2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1536u; +if (i >= 1536u) { return; } +let coord = (i / 512u) % 3u; +if (coord == 0u) { out[i] = f32(b0[((i / 512u) % 1u) * 512u + ((i / 32u) % 16u) * 32u + ((i / 1u) % 32u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..77c9771680a7b21ef657c6b7303a2db2a2eeb5c4 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let x = f32(b0[i]); +out[i] = f32(-x); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9735e1efba0b2297940b84a0830ec5b3b741dbd5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fc751a3c5de6830de0104027f986f119ec7276f2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +let x = f32(b0[i]); +out[i] = f32(exp(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..70f8e98145f911a3fcd4871c31d5a135f54d9382 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 32768u + ((i / 2048u) % 16u) * 128u + ((i / 128u) % 16u) * 2048u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5244c41c17f08956963dde4c3784e8e122ba0e3c0d76794c8b3673252f672f27.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5244c41c17f08956963dde4c3784e8e122ba0e3c0d76794c8b3673252f672f27.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a55ae4a2ab8874671b44a0ffb86ab7aa57ad3d28 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5244c41c17f08956963dde4c3784e8e122ba0e3c0d76794c8b3673252f672f27.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 64u + row) * 18944u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 64u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 64u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 18944u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 64u && col < 18944u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52b439507af68e969a6e116d3c8ea5338a4cde5a3fc1e97b729512d17ab2f4f9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52b439507af68e969a6e116d3c8ea5338a4cde5a3fc1e97b729512d17ab2f4f9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..67ce4656ea03be5b73e9bffd1ef4a470f3754605 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52b439507af68e969a6e116d3c8ea5338a4cde5a3fc1e97b729512d17ab2f4f9.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +out[i] = i32(b0[((i / 1u) % 4u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8bd84e39c2eb7578ff561ba4ef3e07b13ac03aab --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 32768u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 32768u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 32768u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/53d6eb0b5e6d49bfd3bb9fd1b781e13317adf528e047da2416e95f5a3a13b1b4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/53d6eb0b5e6d49bfd3bb9fd1b781e13317adf528e047da2416e95f5a3a13b1b4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b42167010260a49ed2060dcc92a7440b82333b7e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/53d6eb0b5e6d49bfd3bb9fd1b781e13317adf528e047da2416e95f5a3a13b1b4.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 96u) { return; } +out[i] = f32(b0[((i / 32u) % 3u) * 32u + ((i / 32u) % 1u) * 32u + ((i / 32u) % 1u) * 1u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/55b9c48ba429daf80bbae0b4737f895b475abdc9ddfdc88ab2f894f133ec2bf9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/55b9c48ba429daf80bbae0b4737f895b475abdc9ddfdc88ab2f894f133ec2bf9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2af2397f376be638d8bdd9858e37047571ac05c7 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/55b9c48ba429daf80bbae0b4737f895b475abdc9ddfdc88ab2f894f133ec2bf9.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 30720u; +if (i >= 30720u) { return; } +let x = f32(b0[i]); +out[i] = f32(x / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/56167a7e8fb1c67fa72948a8baa71866d54cc775be83f8cfa75a947ac0f58b12.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/56167a7e8fb1c67fa72948a8baa71866d54cc775be83f8cfa75a947ac0f58b12.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..131d933387a2c401768152b9d9a7aebba3045f1d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/56167a7e8fb1c67fa72948a8baa71866d54cc775be83f8cfa75a947ac0f58b12.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 640u; +if (i >= 640u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..207ccef3274729b4ec8b34bb1549e283d3949102 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 64u; + if (row >= 64u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 128u; j++) { + let v = f32(b0[row * 128u + j]); + total += v * v; + } + factor = inverseSqrt(total / 128.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 128u; p += 64u) { + let i = row * 128u + p; + out[i] = f32(f32(b0[row * 128u + p]) * factor * (f32(b1[p]) + 0.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c48577601580a048a286b395db7d42610842728b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 524288u; +if (i >= 524288u) { return; } +let batch = i / 65536u; +let row = (i / 4096u) % 16u; +let col = i % 4096u; +var acc = 0.0; +for (var p = 0u; p < 256u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 4096u) + row * 256u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 4096u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/577120bb3cdd5d1fb64df75a3d9d9bfb7df9a47cbe10c3df4702cdedda8742f2.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/577120bb3cdd5d1fb64df75a3d9d9bfb7df9a47cbe10c3df4702cdedda8742f2.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4d943a2df4febe70053c14959960a8e1e18794c2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/577120bb3cdd5d1fb64df75a3d9d9bfb7df9a47cbe10c3df4702cdedda8742f2.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 131072 || token >= 163840) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 131072) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/57dc406322bf3badd8490493ef924bd7e7e0afd542d2d6e409b4d8a3b4b784f7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/57dc406322bf3badd8490493ef924bd7e7e0afd542d2d6e409b4d8a3b4b784f7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5442fb5e440bbbbc406fb5988a08504f70fb6527 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/57dc406322bf3badd8490493ef924bd7e7e0afd542d2d6e409b4d8a3b4b784f7.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..26c3fcd5a0947b3197d818ca3d28084a0e9883c0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(b0[((i / 1024u) % 1u) * 2048u + ((i / 512u) % 2u) * 1024u + ((i / 32u) % 16u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/58a04f81024c554fa7384cf7989536e51ab65a353203039f95c9787453ee627c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/58a04f81024c554fa7384cf7989536e51ab65a353203039f95c9787453ee627c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2621a473b250ca3d53761f9989f29bfa79441071 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/58a04f81024c554fa7384cf7989536e51ab65a353203039f95c9787453ee627c.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 16u + row) * 18944u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 16u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 16u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 18944u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 16u && col < 18944u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/59ea88d691b919af03bbb26f0253decfbc35d74f9661cdd3a08570ae85c313d2.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/59ea88d691b919af03bbb26f0253decfbc35d74f9661cdd3a08570ae85c313d2.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5330d07c480a06ace52bbbeb6bf873fea1416d6c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/59ea88d691b919af03bbb26f0253decfbc35d74f9661cdd3a08570ae85c313d2.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +let x = f32(b0[i]); +if (x * 1.0 > 20.0) { out[i] = f32(x); return; } +out[i] = f32(log(1.0 + exp(x * 1.0)) / 1.0); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b4abda1ec110ebd592305d0f5da6c3c12a9cd3b2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 256u; + if (row >= 256u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 128u; j++) { + let v = f32(b0[row * 128u + j]); + total += v * v; + } + factor = inverseSqrt(total / 128.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 128u; p += 64u) { + let i = row * 128u + p; + out[i] = f32(f32(b0[row * 128u + p]) * factor * (f32(b1[p]) + 0.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5b490e5074446b3ca05ffdd5f79c18e32aa5c23339dd93c75956125f4caba51f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5b490e5074446b3ca05ffdd5f79c18e32aa5c23339dd93c75956125f4caba51f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..870c6cb0aebb0fde1717398c326d3db43912c502 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5b490e5074446b3ca05ffdd5f79c18e32aa5c23339dd93c75956125f4caba51f.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 1u; + if (row >= 1u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 2048u; j++) { + let v = f32(b0[row * 2048u + j]); + total += v * v; + } + factor = inverseSqrt(total / 2048.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 2048u; p += 64u) { + let i = row * 2048u + p; + out[i] = f32(f32(b0[row * 2048u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5b657fa4e308a89ca0d0edb8cb2a485d6f048dcdbcffb9e2c3a50073be7ad3ff.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5b657fa4e308a89ca0d0edb8cb2a485d6f048dcdbcffb9e2c3a50073be7ad3ff.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..60716a57ed41c31fd5c206966674517aef787748 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5b657fa4e308a89ca0d0edb8cb2a485d6f048dcdbcffb9e2c3a50073be7ad3ff.wgsl @@ -0,0 +1,22 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var b3: array; +@group(0) @binding(4) var b4: array; +@group(0) @binding(5) var b5: array; +@group(0) @binding(6) var b6: array; +@group(0) @binding(7) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 917504u; +if (i >= 917504u) { return; } +let coord = (i / 1u) % 229376u; +if (coord >= 0u && coord < 32768u) { out[i] = f32(b0[(i / 229376u) * 32768u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32768u && coord < 65536u) { out[i] = f32(b1[(i / 229376u) * 32768u + (coord - 32768u) * 1u + i % 1u]); } +if (coord >= 65536u && coord < 98304u) { out[i] = f32(b2[(i / 229376u) * 32768u + (coord - 65536u) * 1u + i % 1u]); } +if (coord >= 98304u && coord < 131072u) { out[i] = f32(b3[(i / 229376u) * 32768u + (coord - 98304u) * 1u + i % 1u]); } +if (coord >= 131072u && coord < 163840u) { out[i] = f32(b4[(i / 229376u) * 32768u + (coord - 131072u) * 1u + i % 1u]); } +if (coord >= 163840u && coord < 196608u) { out[i] = f32(b5[(i / 229376u) * 32768u + (coord - 163840u) * 1u + i % 1u]); } +if (coord >= 196608u && coord < 229376u) { out[i] = f32(b6[(i / 229376u) * 32768u + (coord - 196608u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5c22e6f60217881c0351e38d19057626a6c2292771c1a83816995245777ac2fd.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5c22e6f60217881c0351e38d19057626a6c2292771c1a83816995245777ac2fd.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a0a200bcf1771e18ac73794fa78eac0151343d48 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5c22e6f60217881c0351e38d19057626a6c2292771c1a83816995245777ac2fd.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(b0[((i / 256u) % 1u) * 512u + ((i / 32u) % 8u) * 64u + ((i / 32u) % 1u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5c9a5ae6121b3b10611e09e5f1bc563b70191f2506a2afc0f32de823a9d2dac4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5c9a5ae6121b3b10611e09e5f1bc563b70191f2506a2afc0f32de823a9d2dac4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fd1c96b16a3a569b268cd100091060be8f6f800c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5c9a5ae6121b3b10611e09e5f1bc563b70191f2506a2afc0f32de823a9d2dac4.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b1[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..25fb4a60e0d5dc5c38f4f96bec8ea29068f2e356 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 122880u; +if (i >= 122880u) { return; } +let coord = (i / 1u) % 20u; +if (coord >= 0u && coord < 4u) { out[i] = f32(b0[(i / 20u) * 4u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 4u && coord < 20u) { out[i] = f32(b1[(i / 20u) * 16u + (coord - 4u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5eac5f92aa4d18895369b11adb99ac0d9639d8b615f7240cffe6f6be7046e54a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5eac5f92aa4d18895369b11adb99ac0d9639d8b615f7240cffe6f6be7046e54a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..44b1efb36c66e24c004b699b692f008a68d352e6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5eac5f92aa4d18895369b11adb99ac0d9639d8b615f7240cffe6f6be7046e54a.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 2u; + if (row >= 2u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 256u; j++) { + let v = f32(b0[row * 256u + j]); + total += v * v; + } + factor = inverseSqrt(total / 256.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 256u; p += 64u) { + let i = row * 256u + p; + out[i] = f32(f32(b0[row * 256u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..551de5c0fa29e8a924b81b6fe11c9a2cc3673d1d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..172250df828f8da8336e4e12e54dce7b4361dcca --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[0u * 512u + ((i / 512u) % 1u) * 512u + ((i / 32u) % 16u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f657afde3ab80a1fc4b6739c0b702bc5bd60e52630762e66b210fbb8b42b52a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f657afde3ab80a1fc4b6739c0b702bc5bd60e52630762e66b210fbb8b42b52a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c35d470700b5e1330d30c2ea3f7e0c5d0f77d4a6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f657afde3ab80a1fc4b6739c0b702bc5bd60e52630762e66b210fbb8b42b52a.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 384u; +if (i >= 384u) { return; } +out[i] = f32(b0[((i / 384u) % 1u) * 512u + ((i / 192u) % 2u) * 256u + ((i / 192u) % 1u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ceee99ad7864aec44da1701c29c6722ce73360ea --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[((i / 1u) % 16u) * 1u]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..193a2537b445b31c64b052c52eb4c9d921d70b8a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 192u; +if (i >= 160u) { return; } +out[i] = f32(b0[((i / 160u) % 1u) * 512u + ((i / 10u) % 16u) * 32u + (((i / 1u) % 10u) * 3u + 2u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5fd6e068841f5c054392bef564909dbf086bae9e4030f3625d1143244a08cbbf.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5fd6e068841f5c054392bef564909dbf086bae9e4030f3625d1143244a08cbbf.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d60668fd46afd65337a293687e115ac26feb2dab --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5fd6e068841f5c054392bef564909dbf086bae9e4030f3625d1143244a08cbbf.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5ffab5e011b6e44aae54b4287fcbe68c4a20cee0779818a3178470f3b6d5ffd6.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5ffab5e011b6e44aae54b4287fcbe68c4a20cee0779818a3178470f3b6d5ffd6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c0bf09599bef50a3975853a18604ea616d8def57 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/5ffab5e011b6e44aae54b4287fcbe68c4a20cee0779818a3178470f3b6d5ffd6.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 131072 || token >= 163840) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 131072) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b7d98d8c1120f26495f041687f38c922b7d915a0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..74d1a37530eabc7d2b6883db2e089ed6944b61c0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let batch = i / 1024u; +let row = (i / 256u) % 4u; +let col = i % 256u; +var acc = 0.0; +for (var p = 0u; p < 4096u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 16384u) + row * 4096u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 256u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/62708aacbfcd0063a897e3348ae69a00d4dd155fce6665b18c5176224b039e12.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/62708aacbfcd0063a897e3348ae69a00d4dd155fce6665b18c5176224b039e12.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..629602688d61519650c7ac61b20d5224accd2e22 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/62708aacbfcd0063a897e3348ae69a00d4dd155fce6665b18c5176224b039e12.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 32768 || token >= 65536) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 32768) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/62f30a62c18ed78c9bf37bdc56529accbee2264b9eac931ba0b35a80bb917e7c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/62f30a62c18ed78c9bf37bdc56529accbee2264b9eac931ba0b35a80bb917e7c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f77c378d9485e77efa187d66dd4704a129bbf949 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/62f30a62c18ed78c9bf37bdc56529accbee2264b9eac931ba0b35a80bb917e7c.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +out[i] = f32(b0[2u * 128u + ((i / 128u) % 1u) * 128u + ((i / 32u) % 4u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a41ec428d6e31c551c8314a9e96300e2fc7194e8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 32768u + ((i / 4096u) % 8u) * 256u + ((i / 256u) % 16u) * 2048u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4a5c11bc4a5081edc0742bee29b2392e1756f244 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let x = f32(b0[i]); +out[i] = f32(inverseSqrt(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6633b8c4bd21f4e281eb976cdf9e94037ea3de39224dc79ad89e46b6569f5a60.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6633b8c4bd21f4e281eb976cdf9e94037ea3de39224dc79ad89e46b6569f5a60.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a73f329778aee5d8742667f1eeb289bce2c6fb0a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6633b8c4bd21f4e281eb976cdf9e94037ea3de39224dc79ad89e46b6569f5a60.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 6144u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 6144u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 6144u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/66978c862f8d1e391ded2424a4132cfea5f0cc7686c76610502bb596224db368.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/66978c862f8d1e391ded2424a4132cfea5f0cc7686c76610502bb596224db368.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..57bc7ee776c7a6be6024e5b03295cb9fe17951c2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/66978c862f8d1e391ded2424a4132cfea5f0cc7686c76610502bb596224db368.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 4096u; + if (i >= 4096u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 4096u) * 2048u + p]) * dequant_1((i % 4096u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/66d2c54f014fcbb9053b0710f63280a933d6ad881f5af3c6df4b553c56b53a53.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/66d2c54f014fcbb9053b0710f63280a933d6ad881f5af3c6df4b553c56b53a53.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a529a8f68af7a4e7727fc542d4f86290e03896ea --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/66d2c54f014fcbb9053b0710f63280a933d6ad881f5af3c6df4b553c56b53a53.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 6144u; + let col = index % 6144u; + let word = b1[row * 1536u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 192u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 2048u + col; + var acc = 0.0; + for (var tile = 0u; tile < 6144u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 6144u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 6144u + tile + local.x]); } + if (group.x * 8u + local.y < 2048u && tile + local.x < 6144u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 6144u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 2048u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3262b91520b6a20fc3d4af305fa62d20f7f489f3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 2048u + ((i / 1024u) % 2u) * 256u + ((i / 256u) % 4u) * 512u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/67978e951813ede8016ebf553fb8d3b4ce9e15dd184810544879559208d6b7e1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/67978e951813ede8016ebf553fb8d3b4ce9e15dd184810544879559208d6b7e1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3decac1417ec3c8a4798040f6305fb178904c916 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/67978e951813ede8016ebf553fb8d3b4ce9e15dd184810544879559208d6b7e1.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/687a9faf59b35be173c2861749834333b53400d1dd22bf430cef04722237a309.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/687a9faf59b35be173c2861749834333b53400d1dd22bf430cef04722237a309.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b9310be9718c1ef860ce9c6c007a196a737d0847 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/687a9faf59b35be173c2861749834333b53400d1dd22bf430cef04722237a309.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 98304 || token >= 131072) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 98304) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/690d8dfb579e55be9c90fa8375f6e2ddde55256a6552a59d83e054f34b485ea0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/690d8dfb579e55be9c90fa8375f6e2ddde55256a6552a59d83e054f34b485ea0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8936fc31b8574d16ff2955089500bcb3109d73d8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/690d8dfb579e55be9c90fa8375f6e2ddde55256a6552a59d83e054f34b485ea0.wgsl @@ -0,0 +1,22 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var b3: array; +@group(0) @binding(4) var b4: array; +@group(0) @binding(5) var b5: array; +@group(0) @binding(6) var b6: array; +@group(0) @binding(7) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 229376u; +if (i >= 229376u) { return; } +let coord = (i / 1u) % 229376u; +if (coord >= 0u && coord < 32768u) { out[i] = f32(b0[(i / 229376u) * 32768u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32768u && coord < 65536u) { out[i] = f32(b1[(i / 229376u) * 32768u + (coord - 32768u) * 1u + i % 1u]); } +if (coord >= 65536u && coord < 98304u) { out[i] = f32(b2[(i / 229376u) * 32768u + (coord - 65536u) * 1u + i % 1u]); } +if (coord >= 98304u && coord < 131072u) { out[i] = f32(b3[(i / 229376u) * 32768u + (coord - 98304u) * 1u + i % 1u]); } +if (coord >= 131072u && coord < 163840u) { out[i] = f32(b4[(i / 229376u) * 32768u + (coord - 131072u) * 1u + i % 1u]); } +if (coord >= 163840u && coord < 196608u) { out[i] = f32(b5[(i / 229376u) * 32768u + (coord - 163840u) * 1u + i % 1u]); } +if (coord >= 196608u && coord < 229376u) { out[i] = f32(b6[(i / 229376u) * 32768u + (coord - 196608u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a7942f03138945c79bce1f33264f80e672218280 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +let coord = (i / 2048u) % 3u; +if (coord == 0u) { out[i] = f32(b0[((i / 2048u) % 1u) * 2048u + ((i / 32u) % 64u) * 32u + ((i / 1u) % 32u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/695f529f0e562834854d654e481bdf53c35ad4428f76f66595b3c57cbad54423.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/695f529f0e562834854d654e481bdf53c35ad4428f76f66595b3c57cbad54423.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7bec1dc64aa1048f3ad37f7e66fea2889c5f3325 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/695f529f0e562834854d654e481bdf53c35ad4428f76f66595b3c57cbad54423.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 248320u; +if (i >= 248320u) { return; } +let coord = (i / 1u) % 248320u; +if (coord >= 0u && coord < 229376u) { out[i] = f32(b0[(i / 248320u) * 229376u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 229376u && coord < 248320u) { out[i] = f32(b1[(i / 248320u) * 18944u + (coord - 229376u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6a045508377e47e95d411257071b7ed8f9097fd220c00de6a5167abb548ebe37.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6a045508377e47e95d411257071b7ed8f9097fd220c00de6a5167abb548ebe37.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6bd34a6b3bb77a79fdcd3a519ca2897dc0b8084d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6a045508377e47e95d411257071b7ed8f9097fd220c00de6a5167abb548ebe37.wgsl @@ -0,0 +1,21 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 49152u; +if (i >= 49152u) { return; } +let batch = i / 49152u; +let channel = (i / 8u) % 6144u; +let group = channel / 1u; +var acc = 0.0; +for (var c = 0u; c < 1u; c++) { + for (var p = 0u; p < 4u; p++) { + let pos0 = i32((i / 1u) % 8u) * 1 + i32((p / 1u) % 4u) * 1 - 3; + if (pos0 >= 0 && pos0 < 5) { acc += f32(b0[batch * 30720u + (group * 1u + c) * 5u + u32(pos0) * 1u]) * f32(b1[(channel * 1u + c) * 4u + p]); } + } +} +out[i] = f32(acc + 0.0); + +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6a7b2e3778a02c76155d46fa84aeb33f594954e82e09b6b7f2915c0a606eb3f5.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6a7b2e3778a02c76155d46fa84aeb33f594954e82e09b6b7f2915c0a606eb3f5.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..dbb8e11929641cd77e1054eb002c379556e71409 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6a7b2e3778a02c76155d46fa84aeb33f594954e82e09b6b7f2915c0a606eb3f5.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +var acc = 0.0; +for (var j = 0u; j < 128u; j++) { acc += f32(b0[(((i / 2048u) % 1u) * 262144u + ((i / 128u) % 16u) * 16384u + ((i / 1u) % 128u) * 1u) + (((j / 1u) % 128u) * 128u)]); } +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6ad3e0f21f70c7cb284d8f0115a3e89349d86bb63af4eae8aa70d6c3b1ae1131.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6ad3e0f21f70c7cb284d8f0115a3e89349d86bb63af4eae8aa70d6c3b1ae1131.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..31f36a0ac082983c8213dca39ab175dcdb494993 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6ad3e0f21f70c7cb284d8f0115a3e89349d86bb63af4eae8aa70d6c3b1ae1131.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 6144u; + let col = index % 6144u; + let word = b1[row * 1536u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 192u + col / 32u]; +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 2048u; + if (i >= 2048u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 6144u; p += 64u) { acc += f32(b0[(i / 2048u) * 6144u + p]) * dequant_1((i % 2048u) * 6144u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6ae4c7f13978e60e3f4ccd5b8172af88d7dc24cfdb236e51b826f13a03d8cd02.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6ae4c7f13978e60e3f4ccd5b8172af88d7dc24cfdb236e51b826f13a03d8cd02.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1d620a8021e4cd0706b810a2dbc2ee727980b6c2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6ae4c7f13978e60e3f4ccd5b8172af88d7dc24cfdb236e51b826f13a03d8cd02.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[((i / 512u) % 1u) * 2048u + ((i / 64u) % 8u) * 256u + ((i / 64u) % 1u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..459016f5ff986a1eb3571496fd063c81574182d8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 8192u + ((i / 4096u) % 2u) * 256u + ((i / 256u) % 16u) * 512u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5db8d82fad4be98a827f74b0ec3fc41fc2343ddc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 8192u + ((i / 1024u) % 2u) * 4096u + ((i / 64u) % 16u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..aa5ac8b5beae5c1e53d680c578ece9e674631f78 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl @@ -0,0 +1,13 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { + let i = gid.x + gid.y * 8192u; + if (i >= 8192u) { return; } + let token = (i / 256u) % 16u; + let outer = i / 4096u; + let destination = outer * 1048576u + u32(b1[token]) * 256u + i % 256u; + out[((destination) / 256u) % 4096u * 512u + ((destination) / 1048576u) % 2u * 256u + ((destination) / 1u) % 256u * 1u] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4872a52cf4ada5f89c536415428031fbe79b8ce5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +out[i] = f32(b0[((i / 4096u) % 1u) * 8192u + ((i / 2048u) % 2u) * 4096u + ((i / 32u) % 64u) * 64u + (((i / 1u) % 32u) * 1u + 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..92b787efdff3782565df98fa90a1fd6f3fb1c7bf --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let x = f32(b0[i]); let s = f32(f32(x / (1.0 + exp(-x)))); +out[i] = f32(s * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6e158cae64ceafa60c5498129bbc4482684844432772c61a9f2cfb62482bdeb4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6e158cae64ceafa60c5498129bbc4482684844432772c61a9f2cfb62482bdeb4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..640e4dd31766c45ff37ad7bc03cc5be441b23b4b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/6e158cae64ceafa60c5498129bbc4482684844432772c61a9f2cfb62482bdeb4.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 32768 || token >= 65536) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 32768) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7002f8fdf09f5124ce2875c3540bce3e77750260556fc1a00a8b13b6c1871c30.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7002f8fdf09f5124ce2875c3540bce3e77750260556fc1a00a8b13b6c1871c30.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5296bf14fb8b70f8480bfd7ccbbb1548cc142bca --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7002f8fdf09f5124ce2875c3540bce3e77750260556fc1a00a8b13b6c1871c30.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 1u) % 64u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/70dd45c48a989e6617431d39bc63f0187859f791c0915bcfc95fd6ebf4153403.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/70dd45c48a989e6617431d39bc63f0187859f791c0915bcfc95fd6ebf4153403.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..098c27bdfdb585b984565c227cbcdaa553f56224 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/70dd45c48a989e6617431d39bc63f0187859f791c0915bcfc95fd6ebf4153403.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 512u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 512u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 512u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7121b5c223da0b0f28991f55cfed3c3f3390caa0bf65a8e58ae380db281ceb6b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7121b5c223da0b0f28991f55cfed3c3f3390caa0bf65a8e58ae380db281ceb6b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..69d777ae7caf63f2db83f47bb596dbe1e85a7c4b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7121b5c223da0b0f28991f55cfed3c3f3390caa0bf65a8e58ae380db281ceb6b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 11u) { return; } +out[i] = f32(b0[((i / 11u) % 1u) * 32u + ((i / 11u) % 1u) * 32u + (((i / 1u) % 11u) * 3u + 1u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7183997261247fa4df7e081c0d6d01036fee95b9b57ef944d5f44f72fc80d5fe.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7183997261247fa4df7e081c0d6d01036fee95b9b57ef944d5f44f72fc80d5fe.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..99d3e6e77543d2cc58b39e9dcb97109efd21a2fe --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7183997261247fa4df7e081c0d6d01036fee95b9b57ef944d5f44f72fc80d5fe.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 3u) { return; } +out[i] = i32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/71d38690bcc7fc30f01f1c8fa2f13a38beff889fcb3ff387861bb70038e92129.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/71d38690bcc7fc30f01f1c8fa2f13a38beff889fcb3ff387861bb70038e92129.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a53c6f1656ae08f4e2c239592dc559814e4bdee4 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/71d38690bcc7fc30f01f1c8fa2f13a38beff889fcb3ff387861bb70038e92129.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 192u; +if (i >= 192u) { return; } +out[i] = i32(b0[(((i / 64u) % 3u) * 1u + 1u) * 64u + ((i / 64u) % 1u) * 64u + ((i / 1u) % 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/720dc88131b6bf06e6b09185aa7d5986eb755dcfa60d0e040cbbf621c8f3f761.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/720dc88131b6bf06e6b09185aa7d5986eb755dcfa60d0e040cbbf621c8f3f761.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..77d2c6148b0bb0637e96ebb50a802068507c98e0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/720dc88131b6bf06e6b09185aa7d5986eb755dcfa60d0e040cbbf621c8f3f761.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +let coord = (i / 1u) % 256u; +if (coord >= 0u && coord < 64u) { out[i] = f32(b0[(i / 256u) * 64u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 64u && coord < 256u) { out[i] = f32(b1[(i / 256u) * 192u + (coord - 64u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5724c8466d198ca39894d20505ee5c1a65748333 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[((i / 131072u) % 1u) * 131072u + ((i / 2048u) % 64u) * 128u + ((i / 128u) % 16u) * 8192u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0995f2ce93a8810f3254aea52a51e8c4ae81ab52 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(f32(b0[i]) + (1e-06 * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/742db031d819fdf5a756f37e8e824e2dcb2ca3f30efac3ffbd5918181059ae3a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/742db031d819fdf5a756f37e8e824e2dcb2ca3f30efac3ffbd5918181059ae3a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0879520c73bf4f1395e8a15cc5874fa97dbecde1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/742db031d819fdf5a756f37e8e824e2dcb2ca3f30efac3ffbd5918181059ae3a.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 262144u; +if (i >= 262144u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 16384u) % 16u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1601c2f1c95920dd739e32da0111d879da60655e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 40u) { return; } +out[i] = f32(b0[((i / 40u) % 1u) * 128u + ((i / 10u) % 4u) * 32u + (((i / 1u) % 10u) * 3u + 2u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/764403c33cd8994568e068810380cb57e9f2e326dfc09bed63eed1fbed044da1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/764403c33cd8994568e068810380cb57e9f2e326dfc09bed63eed1fbed044da1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4d0a0fe1c2ad2ca1647d571a4c09e923d06aee0e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/764403c33cd8994568e068810380cb57e9f2e326dfc09bed63eed1fbed044da1.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let x = f32(b0[i]); +out[i] = f32(cos(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c36ce90766882622ae62ab165611a02376cc4d8c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[((i / 1u) % 16u) * 1u]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7928d1b13d79c16f6c0f9d3130cbdb4193cab6efe3a60b38caa1039688fe56de.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7928d1b13d79c16f6c0f9d3130cbdb4193cab6efe3a60b38caa1039688fe56de.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d569f2c70babe1c72d9fa65e789ae8c5bdd2f048 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7928d1b13d79c16f6c0f9d3130cbdb4193cab6efe3a60b38caa1039688fe56de.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 40u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..84ae648de9103180e548eb3ee4ab3414443a58b6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 2048u) % 16u) * 16u + ((i / 128u) % 16u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..99103af983de95f17fcf5da3f5d3989173f352d3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[((i / 1u) % 16u) * 1u]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/79ab685c48a01097e551291e8bb7ea554f69b07f6fd1494aaa829ddcb0eeb8d1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/79ab685c48a01097e551291e8bb7ea554f69b07f6fd1494aaa829ddcb0eeb8d1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..abe1e89b54b42418272a68dccd75fd7fbe236739 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/79ab685c48a01097e551291e8bb7ea554f69b07f6fd1494aaa829ddcb0eeb8d1.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 196608 || token >= 229376) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 196608) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7adea2b745b20a2abb96d02a1fca6db5f06f3c5aac850cf8ae1afa6f50868ded.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7adea2b745b20a2abb96d02a1fca6db5f06f3c5aac850cf8ae1afa6f50868ded.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..71689513a7927e5bc0cb73226d7067f7a4cab739 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7adea2b745b20a2abb96d02a1fca6db5f06f3c5aac850cf8ae1afa6f50868ded.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +let x = f32(b0[i]); +out[i] = f32(cos(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f6badaa4f9e340b199d7d36478143e82014ca9ca --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +out[i] = f32(b0[((i / 4096u) % 1u) * 8192u + ((i / 2048u) % 2u) * 4096u + ((i / 32u) % 64u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7ea4a12734f1206e9c94a060bf6b24732f46685f0c46a78c3c5fbcd64489d8c3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7ea4a12734f1206e9c94a060bf6b24732f46685f0c46a78c3c5fbcd64489d8c3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8e8a838dfb6ac9c617602bd0b2a35a31a9482fbd --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7ea4a12734f1206e9c94a060bf6b24732f46685f0c46a78c3c5fbcd64489d8c3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1536u; +if (i >= 1536u) { return; } +out[i] = f32(b0[((i / 1536u) % 1u) * 2048u + ((i / 192u) % 8u) * 256u + ((i / 192u) % 1u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2793e22a61404445c507c8e43861e8d94b977c7c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 294912u + ((i / 2048u) % 16u) * 18432u + (((i / 128u) % 16u) * 1u + 128u) * 128u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7f7290e4615bdd5b73693e8c235e0a48e0e81ec5a1764fdebd1f04f29be3919a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7f7290e4615bdd5b73693e8c235e0a48e0e81ec5a1764fdebd1f04f29be3919a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..262a044fb656de5d35eaad63c4a332621ae72b96 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7f7290e4615bdd5b73693e8c235e0a48e0e81ec5a1764fdebd1f04f29be3919a.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 64u + row) * 16u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 64u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 64u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 16u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 64u && col < 16u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3c05340808c48d12676c5acad9a623f97573efc1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2097152u; +if (i >= 2097152u) { return; } +out[i] = f32(b0[((i) / 256u) % 4096u * 512u + ((i) / 1048576u) % 2u * 256u + ((i) / 1u) % 256u * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..afbf92723660dbb4d364ef0cbeaf40d4cdc4891a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e6d88d0a15c09579597059a1bdcb1e15f863aa03 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl @@ -0,0 +1,21 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 67584u; +if (i >= 67584u) { return; } +let batch = i / 67584u; +let channel = (i / 11u) % 6144u; +let group = channel / 1u; +var acc = 0.0; +for (var c = 0u; c < 1u; c++) { + for (var p = 0u; p < 4u; p++) { + let pos0 = i32((i / 1u) % 11u) * 1 + i32((p / 1u) % 4u) * 1 - 3; + if (pos0 >= 0 && pos0 < 8) { acc += f32(b0[batch * 49152u + (group * 1u + c) * 8u + u32(pos0) * 1u]) * f32(b1[(channel * 1u + c) * 4u + p]); } + } +} +out[i] = f32(acc + 0.0); + +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9111ceafdc9fd9e44bf84174c85d6fb3627ed1dc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(b0[((i / 1024u) % 1u) * 2048u + ((i / 128u) % 8u) * 256u + ((i / 32u) % 4u) * 64u + (((i / 1u) % 32u) * 1u + 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fd8439ddeb258acd3ccd62679898c9ddc4222a6a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8f492669f518dab2f9593bc47908384f13528421 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +out[i] = f32(b0[((i / 4096u) % 1u) * 8192u + ((i / 512u) % 8u) * 1024u + ((i / 32u) % 16u) * 64u + (((i / 1u) % 32u) * 1u + 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c3b4bd3bde971e325a9fa9e70305b17851fa3dca --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 417792u; +if (i >= 417792u) { return; } +let x = f32(b0[i]); +out[i] = f32(x / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/82bc226410ee45662442e25040b6a6456c2532b87e96860e10f8f0135dde892b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/82bc226410ee45662442e25040b6a6456c2532b87e96860e10f8f0135dde892b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..28de6e0e30293bf23a7829da9811cd25682a84fa --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/82bc226410ee45662442e25040b6a6456c2532b87e96860e10f8f0135dde892b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 12u) { return; } +out[i] = i32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f6253e4954ee69ce5aeefbeb74cb19a00eb2ffe1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b1[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..83350b9cd75974291ce80f1a5b1ab6c19754f7ea --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +out[i] = f32(b0[((i / 2048u) % 3u) * 2048u + ((i / 2048u) % 1u) * 2048u + ((i / 32u) % 64u) * 1u + ((i / 1u) % 32u) * 64u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d9e9b0bf6b9f750aa44134035ca4ba8636f4cf87 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2097152u; +if (i >= 2097152u) { return; } +let batch = i / 262144u; +let row = (i / 4096u) % 64u; +let col = i % 4096u; +var acc = 0.0; +for (var p = 0u; p < 256u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 16384u) + row * 256u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 4096u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8485c3edc4d8013903fedc22091c7530a69a97da8b3dbd0cc5c55f54220709fb.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8485c3edc4d8013903fedc22091c7530a69a97da8b3dbd0cc5c55f54220709fb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..03fbfcf7852f6f66056d6914fe4f0a396e343e10 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8485c3edc4d8013903fedc22091c7530a69a97da8b3dbd0cc5c55f54220709fb.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 65536 || token >= 98304) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 65536) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b838db5172dc04dbd440a1315507258ee731b118 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 32768u + ((i / 2048u) % 16u) * 256u + ((i / 256u) % 8u) * 4096u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4b8f4a81af2551a5f68d4e7183fb44f770c4ce2b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 49152u; +if (i >= 49152u) { return; } +out[i] = f32(b0[((i / 49152u) % 1u) * 67584u + ((i / 8u) % 6144u) * 11u + (((i / 1u) % 8u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8f4401a2be8eee2336c09ba4cc3feb59774b181a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b1[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..39541e77623e367ad5f2dba84b9ea8cf810cb1ee --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let x = f32(b0[i]); let s = f32(f32(x / (1.0 + exp(-x)))); +out[i] = f32(s * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..337252dc904db3cba7455ece03ac6646b17e5989 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(f32(b0[i]) * 0.0625); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ef9b5984a050b004ec691b6fd90a5704e441c981 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/88b50ebddd13f3ff5e2819b8bc956e8fc1346e8f75cacbc3d0edf031b7f1f248.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/88b50ebddd13f3ff5e2819b8bc956e8fc1346e8f75cacbc3d0edf031b7f1f248.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..af3f555638ab88bb67a3930d8f8766ec3b353d87 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/88b50ebddd13f3ff5e2819b8bc956e8fc1346e8f75cacbc3d0edf031b7f1f248.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(f32(b0[i]) * 0.0625); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/892b773325e143ad086ac3f3475f04c606f781b0ea3261a7168d28e3bdf24b49.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/892b773325e143ad086ac3f3475f04c606f781b0ea3261a7168d28e3bdf24b49.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ea5ffc86b925d7b1048789f1a1fd31a66b8f25b0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/892b773325e143ad086ac3f3475f04c606f781b0ea3261a7168d28e3bdf24b49.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 163840 || token >= 196608) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 163840) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/896006749045a93d89dca7ed7326aa05c5ff29423400569d34ab2256dea6b0e4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/896006749045a93d89dca7ed7326aa05c5ff29423400569d34ab2256dea6b0e4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..153b27098a91332adc33e93c50826711f884ea94 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/896006749045a93d89dca7ed7326aa05c5ff29423400569d34ab2256dea6b0e4.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 1u) % 64u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b5f7727d651290008885c57d7eb3d4d47da40e0d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b1[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..cec2de8e203bef278c3c8e0eb2c7a08106ae1575 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 32768u + ((i / 4096u) % 2u) * 16384u + ((i / 64u) % 64u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8a46c4e24d014fd6af88a3f370c4b6161be7c63b6c30211bd62af3dbd87293a8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8a46c4e24d014fd6af88a3f370c4b6161be7c63b6c30211bd62af3dbd87293a8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..879d6b86b22a39f635c45604888a324389324c38 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8a46c4e24d014fd6af88a3f370c4b6161be7c63b6c30211bd62af3dbd87293a8.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(b0[((i / 256u) % 1u) * 512u + ((i / 32u) % 8u) * 64u + ((i / 32u) % 1u) * 64u + (((i / 1u) % 32u) * 1u + 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8acff95e1c324ceae0104784991a5262b08fc893c5b8bd3c7785579cc9958b0f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8acff95e1c324ceae0104784991a5262b08fc893c5b8bd3c7785579cc9958b0f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..986188ac39b4c229d4f2eca450d13b2742bdfd3c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8acff95e1c324ceae0104784991a5262b08fc893c5b8bd3c7785579cc9958b0f.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 6144u; + if (i >= 6144u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 6144u) * 2048u + p]) * dequant_1((i % 6144u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..393e545d035b3c735b85081828588efa2083e5b8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1536u; +if (i >= 1536u) { return; } +out[i] = f32(b0[((i / 1536u) % 1u) * 2048u + ((i / 768u) % 2u) * 1024u + ((i / 192u) % 4u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f6d4d57d5129f06a73030d35c57119eff88a6513 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let coord = (i / 1u) % 256u; +if (coord >= 0u && coord < 64u) { out[i] = f32(b0[(i / 256u) * 64u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 64u && coord < 256u) { out[i] = f32(b1[(i / 256u) * 192u + (coord - 64u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..06d3a0be331bebf0bb3a5e2fbcaa41fd764e10ce --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 8192u + ((i / 256u) % 8u) * 1024u + ((i / 64u) % 4u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..de8c2b01add8ed4522e2cbf58e7f08b03967f1ed --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 122880u; +if (i >= 122880u) { return; } +out[i] = f32(b0[((i / 122880u) % 1u) * 141312u + ((i / 20u) % 6144u) * 23u + (((i / 1u) % 20u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..48bca17aba702ff30048b53673eee423547fd053 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(b0[((i / 256u) % 1u) * 512u + ((i / 128u) % 2u) * 256u + ((i / 32u) % 4u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3120a16a5ed9e9bba8b6482fa4ae14b95803e24d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 98304u; +if (i >= 98304u) { return; } +out[i] = f32(b0[((i / 98304u) % 1u) * 122880u + ((i / 16u) % 6144u) * 20u + (((i / 1u) % 16u) * 1u + 4u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8cce7bfa491959f6a7b62ae9cb861d12e2f4ff05227918a4d06bd80669f0a539.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8cce7bfa491959f6a7b62ae9cb861d12e2f4ff05227918a4d06bd80669f0a539.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..afdc69dc467b8f7f632ffe33bddaf90b521e8362 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8cce7bfa491959f6a7b62ae9cb861d12e2f4ff05227918a4d06bd80669f0a539.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +out[i] = f32(b0[1u * 128u + ((i / 128u) % 1u) * 128u + ((i / 32u) % 4u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8a01c2daa51364f3125cbebcab9dbf7871446a9a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +let x = f32(b0[i]); +out[i] = f32(-x); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3ed04ba7933e584bd12c87751a81db68eb41af8d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1437f79f0859dc59ad95e04ed79a395c48c4012b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let batch = i / 16384u; +let row = (i / 4096u) % 4u; +let col = i % 4096u; +var acc = 0.0; +for (var p = 0u; p < 256u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 1024u) + row * 256u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 4096u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..038f09f18992b3725fd5517a3706736493dfe3b5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 32768u + ((i / 3072u) % 8u) * 4096u + ((i / 192u) % 16u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fe8bfc87f8c17b979d4a5ead82a54af189440ac0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +var acc = 0.0; +for (var j = 0u; j < 128u; j++) { acc += f32(b0[(((i / 256u) % 1u) * 32768u + ((i / 16u) % 16u) * 2048u + ((i / 1u) % 16u) * 128u) + (((j / 1u) % 128u) * 1u)]); } +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..53ed4df03abd87298fb4b30f9c066f6c7e7aa12d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2097152u; +if (i >= 2097152u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[((i / 4096u) % 64u) * 4096u + ((i / 1u) % 4096u) * 1u]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b336d4ef7da9ca1218d2e0bdb97251d2aaeb4513 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 16u; + if (row >= 16u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 2048u; j++) { + let v = f32(b0[row * 2048u + j]); + total += v * v; + } + factor = inverseSqrt(total / 2048.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 2048u; p += 64u) { + let i = row * 2048u + p; + out[i] = f32(f32(b0[row * 2048u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..aed1c7b3a6362fd37da603d94f3f6f17ef9a600f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..de988e579ac17256458e6a635d4588a6072950e3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(b0[((i / 1024u) % 1u) * 2048u + ((i / 128u) % 8u) * 256u + ((i / 32u) % 4u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..99d655d1f60b6210ac848ee998318cb963ff1ede --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl @@ -0,0 +1,34 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 32u; + if (row >= 32u) { return; } + let lane = local.x; + var maximum = -3.4028234663852886e38; + for (var p = lane; p < 4096u; p += 64u) { maximum = max(maximum, f32(b0[row * 4096u + p])); } + partial[lane] = maximum; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] = max(partial[lane], partial[lane + stride]); } + workgroupBarrier(); + } + maximum = partial[0]; + // All lanes must finish reading the maximum before the scratch array is reused. + workgroupBarrier(); + var total = 0.0; + for (var p = lane; p < 4096u; p += 64u) { total += exp(f32(b0[row * 4096u + p]) - maximum); } + partial[lane] = total; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + total = partial[0]; + for (var p = lane; p < 4096u; p += 64u) { + let i = row * 4096u + p; + out[i] = f32(exp(f32(b0[row * 4096u + p]) - maximum) / total); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2e5bc79c78a2b4d66f36a9281f11690ec86715e4 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[((i / 131072u) % 1u) * 262144u + ((i / 2048u) % 64u) * 4096u + ((i / 256u) % 8u) * 512u + (((i / 1u) % 256u) * 1u + 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9144d827dae4c52b80abb829178a9ed901ce5dbc6702ad94b0b355e8eaad5ea5.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9144d827dae4c52b80abb829178a9ed901ce5dbc6702ad94b0b355e8eaad5ea5.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0e196cbf9c5f57d582e8784874efe3d9797e27fe --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9144d827dae4c52b80abb829178a9ed901ce5dbc6702ad94b0b355e8eaad5ea5.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 32u) { return; } +let coord = (i / 1u) % 32u; +if (coord >= 2u && coord < 32u && (coord - 2u) % 3u == 0u) { out[i] = f32(b0[((i / 32u) % 1u) * 10u + ((i / 32u) % 1u) * 10u + ((((i / 1u) % 32u) - 2u) / 3u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0ac306227a2d2906504dd1b01e28be580c908878 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let coord = (i / 1u) % 256u; +if (coord >= 0u && coord < 64u) { out[i] = f32(b0[(i / 256u) * 64u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 64u && coord < 256u) { out[i] = f32(b1[(i / 256u) * 192u + (coord - 64u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3781d841daf679d470aa9b14d0cf4771d03af034 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl @@ -0,0 +1,13 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { + let i = gid.x + gid.y * 2048u; + if (i >= 2048u) { return; } + let token = (i / 256u) % 4u; + let outer = i / 1024u; + let destination = outer * 1048576u + u32(b1[token]) * 256u + i % 256u; + out[((destination) / 256u) % 4096u * 512u + ((destination) / 1048576u) % 2u * 256u + ((destination) / 1u) % 256u * 1u] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/93e55da461fee2fdd3074c679d22ef530e0767cfe37f076dd6a2d538d76576e7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/93e55da461fee2fdd3074c679d22ef530e0767cfe37f076dd6a2d538d76576e7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..27e2a62103b4cb5821cc079c828132a68bfad8b0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/93e55da461fee2fdd3074c679d22ef530e0767cfe37f076dd6a2d538d76576e7.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 2048u; + if (i >= 2048u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 2048u) * 2048u + p]) * dequant_1((i % 2048u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/947f5cc8b3f87e1a0d4d322d9d9e71e2ed16ce6e1f7c91118678c164dc1c8752.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/947f5cc8b3f87e1a0d4d322d9d9e71e2ed16ce6e1f7c91118678c164dc1c8752.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2bb5bd4f5d110df131987419e6018288811ea172 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/947f5cc8b3f87e1a0d4d322d9d9e71e2ed16ce6e1f7c91118678c164dc1c8752.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 96u) { return; } +out[i] = f32(b0[((i / 32u) % 3u) * 32u + ((i / 32u) % 1u) * 32u + ((i / 1u) % 32u) * 1u + ((i / 1u) % 1u) * 32u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..17ace8d19a49ad19d152b1358bcc9f91be800032 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/95addfdb139df33bb3d5c05859412434d318cee0340560537dce4d56a05e159c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/95addfdb139df33bb3d5c05859412434d318cee0340560537dce4d56a05e159c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a5e5b4d6f13125cc2cdaea02ee4549dd7bf38f8b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/95addfdb139df33bb3d5c05859412434d318cee0340560537dce4d56a05e159c.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 2048u + ((i / 2048u) % 1u) * 256u + ((i / 256u) % 8u) * 256u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9c868b10c7c34316c00e41b14857af7bbfe43f60 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +out[i] = f32(b0[0u * 128u + ((i / 128u) % 1u) * 128u + ((i / 32u) % 4u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9625ca0b071511e5261877fd21627ca354ea0219da86a10887e8054afa15dcfd.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9625ca0b071511e5261877fd21627ca354ea0219da86a10887e8054afa15dcfd.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e1f0cf834667ef3ff29080e64d8f9d08e6702c3e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9625ca0b071511e5261877fd21627ca354ea0219da86a10887e8054afa15dcfd.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 32u) { return; } +out[i] = f32(b0[1u * 32u + ((i / 32u) % 1u) * 32u + ((i / 32u) % 1u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/965eda70c95973cd351f2a5097ee9100166c74b6533c36c9eec9873b228cbd30.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/965eda70c95973cd351f2a5097ee9100166c74b6533c36c9eec9873b228cbd30.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9ee34306bafdcc1b453a91a063052abdacd8b5f9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/965eda70c95973cd351f2a5097ee9100166c74b6533c36c9eec9873b228cbd30.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 16u + row) * 512u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 16u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 16u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 512u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 16u && col < 512u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..df4a7b88d0870688be525898c6a657b189a070df --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[((i / 131072u) % 1u) * 393216u + ((i / 8192u) % 16u) * 24576u + (((i / 128u) % 64u) * 1u + 128u) * 128u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/970aa8fd65c7e96611a4b6f30cb0b71e24bdaefff0ca117243cab1a5a7e645a9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/970aa8fd65c7e96611a4b6f30cb0b71e24bdaefff0ca117243cab1a5a7e645a9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2f5b9119322f5487af9c8b2b5da3f2cf33a3c6a2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/970aa8fd65c7e96611a4b6f30cb0b71e24bdaefff0ca117243cab1a5a7e645a9.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 48u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..002611dac2216301bcefb788edbf31a49a191700 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let coord = (i / 1u) % 256u; +if (coord >= 0u && coord < 64u) { out[i] = f32(b0[(i / 256u) * 64u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 64u && coord < 256u) { out[i] = f32(b1[(i / 256u) * 192u + (coord - 64u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fcf179e1efafd4e432e824e62fcb3da6b18866f6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 64u + row) * 32768u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 64u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 64u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 32768u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 64u && col < 32768u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/985bb9ad33654b9adbd4a256d626e346556a10dad514692800da8ebd7910f0f0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/985bb9ad33654b9adbd4a256d626e346556a10dad514692800da8ebd7910f0f0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9018c3fdbf086b98282a94876e8a6631eb5442af --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/985bb9ad33654b9adbd4a256d626e346556a10dad514692800da8ebd7910f0f0.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 3u) { return; } +out[i] = i32(b0[(((i / 1u) % 3u) * 1u + 1u) * 1u + ((i / 1u) % 1u) * 1u + ((i / 1u) % 1u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6f5a0294909820e1048e6c135334639bd4ca22df --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 49152u + ((i / 4u) % 6144u) * 8u + (((i / 1u) % 4u) * 1u + 4u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6f17903f98ea03f7ed94043a81020110ebe8f203 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 122880u + ((i / 4u) % 6144u) * 20u + (((i / 1u) % 4u) * 1u + 16u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9a9c990c9717c93933b1e7f5204d99a16276a177b7ca2f8c8cf61dbc1f6aaf51.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9a9c990c9717c93933b1e7f5204d99a16276a177b7ca2f8c8cf61dbc1f6aaf51.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..113a914b1197768653a3be68fb9e6b5a9e6cfc09 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9a9c990c9717c93933b1e7f5204d99a16276a177b7ca2f8c8cf61dbc1f6aaf51.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 18944u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 18944u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 18944u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ede227a38b1e2608dc62d7a93b0d68ad2fb653fb --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(f32(b0[i]) * 1.0); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e2476989d2a095c8f6a2ba2e76b53b82c3749282 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 417792u; +if (i >= 417792u) { return; } +let coord = (i / 1u) % 68u; +if (coord >= 0u && coord < 4u) { out[i] = f32(b0[(i / 68u) * 4u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 4u && coord < 68u) { out[i] = f32(b1[(i / 68u) * 64u + (coord - 4u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c743049812f0cdac4cac58f95aedc18a7838dbae --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let x = f32(b0[i]); +if (x * 1.0 > 20.0) { out[i] = f32(x); return; } +out[i] = f32(log(1.0 + exp(x * 1.0)) / 1.0); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..433c8d99687959f0d2fba22eeee39545cf88e8ca --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 65536u + ((i / 2048u) % 16u) * 4096u + ((i / 256u) % 8u) * 512u + (((i / 1u) % 256u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..90bdc06efe0122917f683fbb8817bcab407c17a3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 122880u; +if (i >= 122880u) { return; } +let x = f32(b0[i]); +out[i] = f32(x / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9f040facf0594804dba5b0f10f53b11b7223a1e1705896f95a8f95aa0fff5eec.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9f040facf0594804dba5b0f10f53b11b7223a1e1705896f95a8f95aa0fff5eec.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..31bd75024f015a30070af10901b1b0aa5f0a0a89 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/9f040facf0594804dba5b0f10f53b11b7223a1e1705896f95a8f95aa0fff5eec.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let coord = (i / 1u) % 32u; +if (coord >= 1u && coord < 34u && (coord - 1u) % 3u == 0u) { out[i] = f32(b0[((i / 2048u) % 1u) * 704u + ((i / 32u) % 64u) * 11u + ((((i / 1u) % 32u) - 1u) / 3u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..870c26ddb7eaf8dd8335f56cb6a8270f187dcb59 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 393216u; +if (i >= 393216u) { return; } +out[i] = f32(b0[((i / 393216u) % 1u) * 417792u + ((i / 64u) % 6144u) * 68u + (((i / 1u) % 64u) * 1u + 4u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a1a974f6d8d51fd7c3496ede0966af303ad9f0c0c9ee44cf93ec962d2b0e87e1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a1a974f6d8d51fd7c3496ede0966af303ad9f0c0c9ee44cf93ec962d2b0e87e1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..12d890f4a402b0675a5fd2b6d98f661c3f315dd5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a1a974f6d8d51fd7c3496ede0966af303ad9f0c0c9ee44cf93ec962d2b0e87e1.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let x = f32(b0[i]); +out[i] = f32(-x); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a1cf6b03baf18d389f0a2b95440c17125a8ecc1e633568de985d42cac6e0d1cb.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a1cf6b03baf18d389f0a2b95440c17125a8ecc1e633568de985d42cac6e0d1cb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..bef42a5c9cf3a75556610ba3eee2eac25cf19401 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a1cf6b03baf18d389f0a2b95440c17125a8ecc1e633568de985d42cac6e0d1cb.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[1u * 512u + ((i / 512u) % 1u) * 512u + ((i / 32u) % 16u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..58181f1b0116d2180192b51cc8e05ae53f00587d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 98304u; +if (i >= 98304u) { return; } +out[i] = f32(b0[((i / 98304u) % 1u) * 98304u + ((i / 16u) % 6144u) * 1u + ((i / 1u) % 16u) * 6144u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a21dc37cea5d4adc26465d78d5491b794129ded665b3b3c014438c11519a837c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a21dc37cea5d4adc26465d78d5491b794129ded665b3b3c014438c11519a837c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..91e42f4325c36d11aee7518783be2351cb80037d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a21dc37cea5d4adc26465d78d5491b794129ded665b3b3c014438c11519a837c.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 196608 || token >= 229376) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 196608) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5466706ae8a51fb919a0c6e3bdc851986df7c3b3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 98304u + ((i / 2048u) % 16u) * 6144u + (((i / 1u) % 2048u) * 1u + 4096u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a26ccdf9414d63e640b21dbfb8191252a532ad248ad8a975bf64438d6c861edb.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a26ccdf9414d63e640b21dbfb8191252a532ad248ad8a975bf64438d6c861edb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0fc6e673512b1623bed3f2d93e89c5c49f8efdc9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a26ccdf9414d63e640b21dbfb8191252a532ad248ad8a975bf64438d6c861edb.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 0 || token >= 32768) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 0) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a2bd65fc2709e093644d6cbf0c292b4d71520009a87bedcf4bca8fcb5f5c15b8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a2bd65fc2709e093644d6cbf0c292b4d71520009a87bedcf4bca8fcb5f5c15b8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a3b7ba18c0aa6c84088bfae203f30b202cf1cedc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a2bd65fc2709e093644d6cbf0c292b4d71520009a87bedcf4bca8fcb5f5c15b8.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 12u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0f992f99ce37f07be233993c8dabc7fe235ba666 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a37dac611b27158f19aa5bd70c43217286e610e733cbd602b91666b4af42d3ef.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a37dac611b27158f19aa5bd70c43217286e610e733cbd602b91666b4af42d3ef.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c0eaa7ea6d730c603c8ce3193ea9e00a3ec74433 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a37dac611b27158f19aa5bd70c43217286e610e733cbd602b91666b4af42d3ef.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 1u) { return; } +out[i] = i32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3ae9e0043808929344cd1e40bf60a2dc532aac06 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..94caaa605cd85dfadbdb72f49366b2f40ac3ddcf --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl @@ -0,0 +1,44 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var b3: array; +@group(0) @binding(4) var b4: array; +@group(0) @binding(5) var b5: array; +@group(0) @binding(6) var out: array; + +var partial: array; +var delta: f32; +@compute @workgroup_size(128) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let column = group.x; + let head = group.y; + let batch_index = group.z; + let lane = local.x; + var recurrent = 0.0; + if (lane < 128u) { recurrent = f32(b5[((batch_index * 16u + head) * 128u + lane) * 128u + column]); } + for (var token = 0u; token < 64u; token++) { + recurrent *= exp(f32(b3[(batch_index * 64u + token) * 16u + head])); + partial[lane] = 0.0; + if (lane < 128u) { partial[lane] = recurrent * f32(b1[((batch_index * 64u + token) * 16u + head) * 128u + lane]); } + workgroupBarrier(); + for (var stride = 64u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { delta = (f32(b2[((batch_index * 64u + token) * 16u + head) * 128u + column]) - partial[0]) * f32(b4[(batch_index * 64u + token) * 16u + head]); } + workgroupBarrier(); + if (lane < 128u) { recurrent += f32(b1[((batch_index * 64u + token) * 16u + head) * 128u + lane]) * delta; } + partial[lane] = 0.0; + if (lane < 128u) { + partial[lane] = recurrent * f32(b0[((batch_index * 64u + token) * 16u + head) * 128u + lane]) * 0.08838834764831845; + } + workgroupBarrier(); + for (var stride = 64u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[((batch_index * 16u + head) * 192u + 128u + token) * 128u + column] = f32(partial[0]); } + workgroupBarrier(); + } + if (lane < 128u) { out[((batch_index * 16u + head) * 192u + lane) * 128u + column] = f32(recurrent); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a672c3e158716bde7444c8141f3df1da16da739ccdd2eb2ad60f9d42d0775157.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a672c3e158716bde7444c8141f3df1da16da739ccdd2eb2ad60f9d42d0775157.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..aa456f658303b9267eb9faab7425cd740bbdc6f5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a672c3e158716bde7444c8141f3df1da16da739ccdd2eb2ad60f9d42d0775157.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let coord = (i / 128u) % 1u; +if (coord == 0u) { out[i] = f32(b0[((i / 2048u) % 1u) * 2048u + ((i / 128u) % 16u) * 128u + ((i / 1u) % 128u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8f7e080e8cee8c2acabacf51697ca01fe402a237 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 96u) { return; } +out[i] = f32(b0[((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..58aa0b8cdce7083ab78ef1d07209c0fb7453bfd4 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 98304u; +if (i >= 98304u) { return; } +out[i] = f32(b0[((i / 98304u) % 1u) * 98304u + ((i / 6144u) % 16u) * 1u + ((i / 1u) % 6144u) * 16u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fe108ca011aeda32468d08a7ba7e1941f1632006 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 393216u; +if (i >= 393216u) { return; } +out[i] = f32(b0[((i / 393216u) % 1u) * 393216u + ((i / 64u) % 6144u) * 1u + ((i / 1u) % 64u) * 6144u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a87152b0fd2f78f60d7abb61c2f6c4a9bde8a9dd45d0275b58d760a3da9f71ce.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a87152b0fd2f78f60d7abb61c2f6c4a9bde8a9dd45d0275b58d760a3da9f71ce.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a411756a9239877ab739c80010eb78b97e1cc130 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a87152b0fd2f78f60d7abb61c2f6c4a9bde8a9dd45d0275b58d760a3da9f71ce.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 384u; +if (i >= 384u) { return; } +let batch = i / 128u; +let row = (i / 4u) % 32u; +let col = i % 4u; +var acc = 0.0; +for (var p = 0u; p < 1u; p++) { + acc += f32(b0[(((batch / 1u) % 3u) * 32u) + row * 1u + p]) * f32(b1[(((batch / 1u) % 3u) * 4u) + p * 4u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a896c93b04922c0f78f1c77fbaabbc79eb71776223748bb32a6d5339e32029e8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a896c93b04922c0f78f1c77fbaabbc79eb71776223748bb32a6d5339e32029e8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a442553393b20f2c68a57efbb6d0eccae8d1c425 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a896c93b04922c0f78f1c77fbaabbc79eb71776223748bb32a6d5339e32029e8.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = i32(b0[((i / 1u) % 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..70a57f24ff695b932429f61024d4f9a7cf194254 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 24576u + ((i / 2048u) % 4u) * 6144u + (((i / 1u) % 2048u) * 1u + 2048u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4bd4cd7da7a46d9f8234fcb621a58a1e37822d4c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9fa5db20fa8de1de429c6850c3e40ff8180bcdb59373919b84d2438b3b17352.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9fa5db20fa8de1de429c6850c3e40ff8180bcdb59373919b84d2438b3b17352.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..44a1dd646db06ca3b9e95fa43d9ecf152f916a44 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/a9fa5db20fa8de1de429c6850c3e40ff8180bcdb59373919b84d2438b3b17352.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 48u) { return; } +out[i] = i32(b0[(((i / 16u) % 3u) * 1u + 1u) * 16u + ((i / 16u) % 1u) * 16u + ((i / 1u) % 16u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2a2a259f750aef9c48507b8fa223d1c4de2f1364 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aa59c60790adcd3ed6930671d42ad5f38c4947fcaa607270ddc2e337c19ddc46.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aa59c60790adcd3ed6930671d42ad5f38c4947fcaa607270ddc2e337c19ddc46.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..923688c1e4d0e3a8e4aad08b41848f0c1ae3e200 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aa59c60790adcd3ed6930671d42ad5f38c4947fcaa607270ddc2e337c19ddc46.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 16u; + if (i >= 16u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 16u) * 2048u + p]) * dequant_1((i % 16u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..197ac86366a010949ab6555925b7746073f2838b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 65536u; +if (i >= 65536u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/abdb17daf29310a7828a55a1efeebaa65b6553e236fc20702e8c712e0a46dd5b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/abdb17daf29310a7828a55a1efeebaa65b6553e236fc20702e8c712e0a46dd5b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0e63cebe9c685e72f2ef3807fe8a83b8853e6dd9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/abdb17daf29310a7828a55a1efeebaa65b6553e236fc20702e8c712e0a46dd5b.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..74186e66e6477562a7428f1d974871861d33807f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[((i / 131072u) % 1u) * 393216u + ((i / 2048u) % 64u) * 6144u + (((i / 1u) % 2048u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..858a9ddea19febd0c8d4aa96d6c9c9c4ee26b4a8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let batch = i / 4096u; +let row = (i / 256u) % 16u; +let col = i % 256u; +var acc = 0.0; +for (var p = 0u; p < 4096u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 65536u) + row * 4096u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 256u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4493ec84a6a3ecaad780645eb74fd1900795ba99 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[((i / 512u) % 1u) * 2048u + ((i / 256u) % 2u) * 1024u + ((i / 64u) % 4u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f6c7872687b7bdd3f9a0ce5853f90ec21d96e2d3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +let x = f32(b0[i]); +out[i] = f32(-x); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ae69e698c92571766e36ad8c078b13e42bde56745d45698daaadaca587b7279c.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ae69e698c92571766e36ad8c078b13e42bde56745d45698daaadaca587b7279c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..48686d13bb0682a3b49a3239768a42f4ae4217d8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ae69e698c92571766e36ad8c078b13e42bde56745d45698daaadaca587b7279c.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +let coord = (i / 1u) % 32u; +if (coord >= 2u && coord < 32u && (coord - 2u) % 3u == 0u) { out[i] = f32(b0[((i / 128u) % 1u) * 40u + ((i / 32u) % 4u) * 10u + ((((i / 1u) % 32u) - 2u) / 3u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aeee4bc86f9b4986043125d462e8fed051591da36bd013e5c7c31c3449353452.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aeee4bc86f9b4986043125d462e8fed051591da36bd013e5c7c31c3449353452.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3b5256f5848d9ccff55ceddf1a5f6577551991d9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/aeee4bc86f9b4986043125d462e8fed051591da36bd013e5c7c31c3449353452.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 229376 || token >= 248320) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 229376) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b02b0be460d581c720afd68c8b722e8da47e2ee432b5d61bbdf24b6084cb2f26.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b02b0be460d581c720afd68c8b722e8da47e2ee432b5d61bbdf24b6084cb2f26.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..149a4ba7b993cd3c7a5ae3d437265ae0e1001e0e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b02b0be460d581c720afd68c8b722e8da47e2ee432b5d61bbdf24b6084cb2f26.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let x = f32(b0[i]); let s = f32(f32(x / (1.0 + exp(-x)))); +out[i] = f32(s * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..59029583047b1c87c1e71eb358d7b73fbc8adba5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1536u; +if (i >= 1536u) { return; } +out[i] = f32(b0[((i / 512u) % 3u) * 512u + ((i / 512u) % 1u) * 512u + ((i / 32u) % 16u) * 1u + ((i / 1u) % 32u) * 16u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b1741cc45db17fa6e66bd797a89a3e3ca7cc70854e55c9e549d4f8500ef5a509.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b1741cc45db17fa6e66bd797a89a3e3ca7cc70854e55c9e549d4f8500ef5a509.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..35f6b6116708bc1a863cae354eaa371f9d69675a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b1741cc45db17fa6e66bd797a89a3e3ca7cc70854e55c9e549d4f8500ef5a509.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 98304 || token >= 131072) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 98304) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b199d835db70f888c7b99a3ac6e9ec56f6c47d5bba4eaf352e0a8eabed56411e.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b199d835db70f888c7b99a3ac6e9ec56f6c47d5bba4eaf352e0a8eabed56411e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..54526e84e0f57f0b27c2e0d57273b25cde83790f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b199d835db70f888c7b99a3ac6e9ec56f6c47d5bba4eaf352e0a8eabed56411e.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 128u) % 16u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9b18092deac8f9ecf759c438a10098e2899a4448 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d7c92bd3f3a7e5b1883a4c8b38d5e18114b7fd53 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(b0[((i / 256u) % 1u) * 512u + ((i / 128u) % 2u) * 256u + ((i / 32u) % 4u) * 64u + (((i / 1u) % 32u) * 1u + 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b2b16798cbe94c919025d76b0435afe47966ffdd1ea53ec74a791c03c4709a28.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b2b16798cbe94c919025d76b0435afe47966ffdd1ea53ec74a791c03c4709a28.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4d8a5bb75deb878ba50367abeb2220352b270284 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b2b16798cbe94c919025d76b0435afe47966ffdd1ea53ec74a791c03c4709a28.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 30720u; +if (i >= 30720u) { return; } +out[i] = f32(b0[((i / 30720u) % 1u) * 49152u + ((i / 5u) % 6144u) * 8u + (((i / 1u) % 5u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..71e65d6a93cf6c0306d093bbd7707c022315afe0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4194240u; +if (i >= 8388608u) { return; } +out[i] = f32(b0[((i / 8388608u) % 1u) * 8388608u + ((i / 1048576u) % 8u) * 1048576u + ((i / 4096u) % 256u) * 1u + ((i / 1u) % 4096u) * 256u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3bb2905555188f535b6b8bc1d050c142b5fea8222d9ef193466f80aa2c54dea.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3bb2905555188f535b6b8bc1d050c142b5fea8222d9ef193466f80aa2c54dea.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6b99413ee370aa1076606344bd7a730d9634394d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3bb2905555188f535b6b8bc1d050c142b5fea8222d9ef193466f80aa2c54dea.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let coord = (i / 1u) % 32u; +if (coord >= 2u && coord < 32u && (coord - 2u) % 3u == 0u) { out[i] = f32(b0[((i / 2048u) % 1u) * 640u + ((i / 32u) % 64u) * 10u + ((((i / 1u) % 32u) - 2u) / 3u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3c44f5f11a5fcc5c32ce6a1167f2b1232839113872306dcd7023ad9fe385c29.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3c44f5f11a5fcc5c32ce6a1167f2b1232839113872306dcd7023ad9fe385c29.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c35dcfad8be1b65bb809526743e3d9e3d133bb3c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b3c44f5f11a5fcc5c32ce6a1167f2b1232839113872306dcd7023ad9fe385c29.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 192u; +if (i >= 192u) { return; } +out[i] = i32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b57928140994202536cd4f99d2e14f5dba9754f014843673790d5d48c9cbb9ab.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b57928140994202536cd4f99d2e14f5dba9754f014843673790d5d48c9cbb9ab.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a5d1a988399067b52e6658a8d39dcbfac3d81a20 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b57928140994202536cd4f99d2e14f5dba9754f014843673790d5d48c9cbb9ab.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[((i / 512u) % 1u) * 512u + ((i / 256u) % 2u) * 256u + ((i / 256u) % 1u) * 512u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9977e082147cbcb3bb693d292b2bdfcee26bb38a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +out[i] = f32(b0[((i / 4096u) % 1u) * 8192u + ((i / 512u) % 8u) * 1024u + ((i / 32u) % 16u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b64a63c60f91d717d7879df834c3443b1675c875093fad7b05da47fac5d61fc4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b64a63c60f91d717d7879df834c3443b1675c875093fad7b05da47fac5d61fc4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4ad6c7961a8cc11315fa39c63aeaf86041ffccb9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b64a63c60f91d717d7879df834c3443b1675c875093fad7b05da47fac5d61fc4.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 303104u; +if (i >= 303104u) { return; } +let coord = (i / 1u) % 18944u; +if (coord >= 0u && coord < 18944u) { out[i] = f32(b0[(i / 18944u) * 18944u + (coord - 0u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..174ea30cc2482fd8884ac2284af35d964b934cbf --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 49152u; +if (i >= 49152u) { return; } +let x = f32(b0[i]); +out[i] = f32(x / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ba2fd5d2796d03870e6787ea917515484f75affcf1c686e659be259525b60f72.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ba2fd5d2796d03870e6787ea917515484f75affcf1c686e659be259525b60f72.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..bc91cbac17b787a831e093b462bbdd3e3e75211e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ba2fd5d2796d03870e6787ea917515484f75affcf1c686e659be259525b60f72.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 64u + row) * 512u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 64u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 64u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 512u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 64u && col < 512u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4e3d4966600c9fa703e8af8c55e751691948715a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 262144u; +if (i >= 262144u) { return; } +out[i] = f32(b0[((i / 262144u) % 1u) * 393216u + ((i / 16384u) % 16u) * 24576u + (((i / 128u) % 128u) * 1u + 0u) * 128u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bb9029b667eeb13670d1f640cd677c6eabd7a7569686c599e3eeb9482d642b00.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bb9029b667eeb13670d1f640cd677c6eabd7a7569686c599e3eeb9482d642b00.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..70d42d4c763bcca299e524c1695c1ae352353cd9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bb9029b667eeb13670d1f640cd677c6eabd7a7569686c599e3eeb9482d642b00.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) - (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bbd5391ed53f61346ee046aaa2fefdc65ea0ffde1ca891b51e4586b745f453c0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bbd5391ed53f61346ee046aaa2fefdc65ea0ffde1ca891b51e4586b745f453c0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7cc6a1075ab1ae122461318cc60febc8b0c7e935 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bbd5391ed53f61346ee046aaa2fefdc65ea0ffde1ca891b51e4586b745f453c0.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 2048u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 2048u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 2048u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bc22275618821f75af681d7a4d901fcd863aefc1ab3cf44da85ef9b0cf8b6790.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bc22275618821f75af681d7a4d901fcd863aefc1ab3cf44da85ef9b0cf8b6790.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7105e938db754bf010622aa64590bb8b926504e1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bc22275618821f75af681d7a4d901fcd863aefc1ab3cf44da85ef9b0cf8b6790.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 229376 || token >= 248320) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 229376) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2e79845d2a74341a4c1a33d8faccf3e7441bc787 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 4u; + if (row >= 4u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 2048u; j++) { + let v = f32(b0[row * 2048u + j]); + total += v * v; + } + factor = inverseSqrt(total / 2048.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 2048u; p += 64u) { + let i = row * 2048u + p; + out[i] = f32(f32(b0[row * 2048u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7b4dd957fd1c7e8dcb9f85dae6fcf264becc9365 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 32768u + ((i / 16384u) % 2u) * 256u + ((i / 256u) % 64u) * 512u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e1eaf48755f6c89edfa173b16d7f022444d1cc0d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 32768u + ((i / 12288u) % 2u) * 16384u + ((i / 192u) % 64u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a6362c1ba2be5818f23846f039d679fea5bafbf3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 417792u + ((i / 4u) % 6144u) * 68u + (((i / 1u) % 4u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4d0f8a39c69d540e4ebe14901bb8411835e15afb --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b1[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..cb1e79634a79e0cdf98a873e21b34a8285f58367 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(f32(b0[((i / 1u) % 16u) * 1u]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c0a7f99d0ce8f9a199b9baa52effe47afa9605f77405c32b32d132be1f7404f1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c0a7f99d0ce8f9a199b9baa52effe47afa9605f77405c32b32d132be1f7404f1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..bf490a01533f687f754f69957cc65aa09be66c54 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c0a7f99d0ce8f9a199b9baa52effe47afa9605f77405c32b32d132be1f7404f1.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c0b2947798baa198598d75ca0e5dcd31a9fa320499665e34f7bb81d27fc15fb0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c0b2947798baa198598d75ca0e5dcd31a9fa320499665e34f7bb81d27fc15fb0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..bb8b3676ab0dfbc0c5c78d28f96387bc3a721046 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c0b2947798baa198598d75ca0e5dcd31a9fa320499665e34f7bb81d27fc15fb0.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let x = f32(b0[i]); +out[i] = f32(cos(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0c6c020c365e592254d9a01952f5a009adc5a22f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +var acc = 0.0; +for (var j = 0u; j < 128u; j++) { acc += f32(b0[(((i / 64u) % 1u) * 8192u + ((i / 16u) % 4u) * 2048u + ((i / 1u) % 16u) * 128u) + (((j / 1u) % 128u) * 1u)]); } +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c23bee3c3664172bf0a078a96acd2b3ad3136732234975f757d313e696c2c37a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c23bee3c3664172bf0a078a96acd2b3ad3136732234975f757d313e696c2c37a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2d80755364a4fee024c589b10f9f00932c251576 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c23bee3c3664172bf0a078a96acd2b3ad3136732234975f757d313e696c2c37a.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +out[i] = f32(f32(b0[((i / 1u) % 16u) * 1u]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ab5764fc85cf04731216d5178e63dfc02d07826a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 98304u + ((i / 2048u) % 16u) * 6144u + (((i / 1u) % 2048u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..22b9338f6e2f9c6948f9be91fb996e767aa1f5dc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4194240u; +if (i >= 8388608u) { return; } +out[i] = f32(b0[((i / 4194304u) % 2u) * 1048576u + ((i / 256u) % 4096u) * 256u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..12098533864f80930cf478bcf965d633589f8010 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl @@ -0,0 +1,34 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 512u; + if (row >= 512u) { return; } + let lane = local.x; + var maximum = -3.4028234663852886e38; + for (var p = lane; p < 4096u; p += 64u) { maximum = max(maximum, f32(b0[row * 4096u + p])); } + partial[lane] = maximum; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] = max(partial[lane], partial[lane + stride]); } + workgroupBarrier(); + } + maximum = partial[0]; + // All lanes must finish reading the maximum before the scratch array is reused. + workgroupBarrier(); + var total = 0.0; + for (var p = lane; p < 4096u; p += 64u) { total += exp(f32(b0[row * 4096u + p]) - maximum); } + partial[lane] = total; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + total = partial[0]; + for (var p = lane; p < 4096u; p += 64u) { + let i = row * 4096u + p; + out[i] = f32(exp(f32(b0[row * 4096u + p]) - maximum) / total); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2c806bbe93f09247867b4ace45489a5f2fe3ee67f265418eb7aa71a29880276.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2c806bbe93f09247867b4ace45489a5f2fe3ee67f265418eb7aa71a29880276.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fa4df64a06b41dc3305ec748ea504d435a19aa23 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2c806bbe93f09247867b4ace45489a5f2fe3ee67f265418eb7aa71a29880276.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +let x = f32(b0[i]); +out[i] = f32(inverseSqrt(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2e7cdc03edb25ef7a160965c17c559b6ec7e139c145dc7390b73523bacba5bb.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2e7cdc03edb25ef7a160965c17c559b6ec7e139c145dc7390b73523bacba5bb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fa9bac520b006ea9afd50beaa3b3f67aa0df0eef --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c2e7cdc03edb25ef7a160965c17c559b6ec7e139c145dc7390b73523bacba5bb.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 192u; +if (i >= 160u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c34050971c037d57e84cc2cb44cf16ab73314cd30068d733c5ca430df1eea52d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c34050971c037d57e84cc2cb44cf16ab73314cd30068d733c5ca430df1eea52d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..170d9e8cf274724044f695c086efc6499f422d0d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c34050971c037d57e84cc2cb44cf16ab73314cd30068d733c5ca430df1eea52d.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 163840 || token >= 196608) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 163840) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4e167ce6a7ce9917f434844c31163e81a8ec4800 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(f32(b0[((i / 1u) % 16u) * 1u]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..68bb70490bf5d2d463fb8fe40f5bec228d3c516f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 2048u) % 4u) * 16u + ((i / 128u) % 16u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..22bcefa0ff08fd3a5375ea57e17ff7f0cda1d768 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 1024u; + if (row >= 1024u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 128u; j++) { + let v = f32(b0[row * 128u + j]); + total += v * v; + } + factor = inverseSqrt(total / 128.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 128u; p += 64u) { + let i = row * 128u + p; + out[i] = f32(f32(b0[row * 128u + p]) * factor * (f32(b1[p]) + 0.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3bd80f93b1c138960984d55cff71cd88a93016723f80d30b3340ddb503620c4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3bd80f93b1c138960984d55cff71cd88a93016723f80d30b3340ddb503620c4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ac889ec998ac178cc9f6a5a9884746f1140aa026 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c3bd80f93b1c138960984d55cff71cd88a93016723f80d30b3340ddb503620c4.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 64u + row) * 2048u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 64u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 64u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 2048u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 64u && col < 2048u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c4862be63d2532b6891da039edbef2f46737a34518f8a89602821e00447b5933.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c4862be63d2532b6891da039edbef2f46737a34518f8a89602821e00447b5933.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7e12c353c29523774d93254e8dc9f119ce04b4fb --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c4862be63d2532b6891da039edbef2f46737a34518f8a89602821e00447b5933.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 6144u + ((i / 2048u) % 1u) * 6144u + (((i / 1u) % 2048u) * 1u + 2048u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ceffcce3113d363ae38d0760c9af3a93e2a924d3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 32u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c804a18a7bed0d1c647838cab84658e1a40005fc2100decef96e2ed66e1f8c0b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c804a18a7bed0d1c647838cab84658e1a40005fc2100decef96e2ed66e1f8c0b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..054c81c58a8f3ba4e69eba29f1b719a1e71b6b2a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c804a18a7bed0d1c647838cab84658e1a40005fc2100decef96e2ed66e1f8c0b.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1212416u; +if (i >= 1212416u) { return; } +let coord = (i / 1u) % 18944u; +if (coord >= 0u && coord < 18944u) { out[i] = f32(b0[(i / 18944u) * 18944u + (coord - 0u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c82539b0cdc61c953c4b7feb51ddc9a52206bd51b37bd1a22e45830e5e6162d7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c82539b0cdc61c953c4b7feb51ddc9a52206bd51b37bd1a22e45830e5e6162d7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0bb8db76ac4be14d2b734cb5cd1dee35d823aa59 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c82539b0cdc61c953c4b7feb51ddc9a52206bd51b37bd1a22e45830e5e6162d7.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 6144u; + let col = index % 6144u; + let word = b1[row * 1536u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 192u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 64u + row) * 2048u + col; + var acc = 0.0; + for (var tile = 0u; tile < 6144u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 64u && tile + local.x < 6144u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 64u + row) * 6144u + tile + local.x]); } + if (group.x * 8u + local.y < 2048u && tile + local.x < 6144u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 6144u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 64u && col < 2048u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c83a2a6faf563ec3bbad43a3e108d58c09cd8aeed01b38e4e82d1c3c9b650c21.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c83a2a6faf563ec3bbad43a3e108d58c09cd8aeed01b38e4e82d1c3c9b650c21.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..19ed701e6f3435af2e4cac80f2299fec71288328 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c83a2a6faf563ec3bbad43a3e108d58c09cd8aeed01b38e4e82d1c3c9b650c21.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[2u * 2048u + ((i / 2048u) % 1u) * 2048u + ((i / 32u) % 64u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c8c077eea97ee78f1f10dacccd47d60cd76278ea99d0863ce3ca8f16601785bd.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c8c077eea97ee78f1f10dacccd47d60cd76278ea99d0863ce3ca8f16601785bd.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..000be5b1753f3e2446518145ae3cfc8a016c2daa --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c8c077eea97ee78f1f10dacccd47d60cd76278ea99d0863ce3ca8f16601785bd.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 75776u; +if (i >= 75776u) { return; } +let coord = (i / 1u) % 18944u; +if (coord >= 0u && coord < 18944u) { out[i] = f32(b0[(i / 18944u) * 18944u + (coord - 0u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c90428425f6d220b441e97e3b894adfb090869c98b17f53afbd2f9fb202b4525.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c90428425f6d220b441e97e3b894adfb090869c98b17f53afbd2f9fb202b4525.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6bbc472bea9c8d96ae70e94b1ca3e146cd081981 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c90428425f6d220b441e97e3b894adfb090869c98b17f53afbd2f9fb202b4525.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let x = f32(b0[i]); +out[i] = f32(sin(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c9d90936ab6b78afdcd34c23c05b9b3cd93c021ccf9ac1645714b6a919f6dfbd.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c9d90936ab6b78afdcd34c23c05b9b3cd93c021ccf9ac1645714b6a919f6dfbd.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..888863566f0dabfb6848daeeb06947fbdaac9f9b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c9d90936ab6b78afdcd34c23c05b9b3cd93c021ccf9ac1645714b6a919f6dfbd.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 131072 || token >= 163840) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 131072) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c9c837a1926cf2071a7767c482bfd9348bd9b4b5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ca9a3115f8f3881eee99e421cb4f259113b13bb4c107348279bb92c643a52197.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ca9a3115f8f3881eee99e421cb4f259113b13bb4c107348279bb92c643a52197.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a23bfb9bcccaa79b5dac185105bff8ca820bb74d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ca9a3115f8f3881eee99e421cb4f259113b13bb4c107348279bb92c643a52197.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let x = f32(b0[i]); +out[i] = f32(sin(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cc250879ffbf43ba05860b5a86f6a824e8ca7b4c9f820137a68e1ba633e09738.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cc250879ffbf43ba05860b5a86f6a824e8ca7b4c9f820137a68e1ba633e09738.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f99a31a5530ee04c3f3573c324dd7c6471dc1049 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cc250879ffbf43ba05860b5a86f6a824e8ca7b4c9f820137a68e1ba633e09738.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 96u) { return; } +let batch = i / 32u; +let row = (i / 1u) % 32u; +let col = i % 1u; +var acc = 0.0; +for (var p = 0u; p < 1u; p++) { + acc += f32(b0[(((batch / 1u) % 3u) * 32u) + row * 1u + p]) * f32(b1[(((batch / 1u) % 3u) * 1u) + p * 1u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ccb303d2d38ef10c1cf514f01ec2fa3b2541734aca8a34b3e8bb8d71d03a6688.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ccb303d2d38ef10c1cf514f01ec2fa3b2541734aca8a34b3e8bb8d71d03a6688.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..228b4bbd0824c9c80c477855a3d00e3274aa4588 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ccb303d2d38ef10c1cf514f01ec2fa3b2541734aca8a34b3e8bb8d71d03a6688.wgsl @@ -0,0 +1,13 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { + let i = gid.x + gid.y * 512u; + if (i >= 512u) { return; } + let token = (i / 256u) % 1u; + let outer = i / 256u; + let destination = outer * 1048576u + u32(b1[token]) * 256u + i % 256u; + out[((destination) / 256u) % 4096u * 512u + ((destination) / 1048576u) % 2u * 256u + ((destination) / 1u) % 256u * 1u] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..09fcea174bf26710815b865219fd6f9b01ee9aa1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 2048u) % 64u) * 16u + ((i / 128u) % 16u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cdc784b39918d10424edc08d2e44da0075863e8fd41ae362f5695a248363531d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cdc784b39918d10424edc08d2e44da0075863e8fd41ae362f5695a248363531d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ee515425cf5358aa221f3366d77a028e1327f04d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/cdc784b39918d10424edc08d2e44da0075863e8fd41ae362f5695a248363531d.wgsl @@ -0,0 +1,34 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 8u; + if (row >= 8u) { return; } + let lane = local.x; + var maximum = -3.4028234663852886e38; + for (var p = lane; p < 4096u; p += 64u) { maximum = max(maximum, f32(b0[row * 4096u + p])); } + partial[lane] = maximum; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] = max(partial[lane], partial[lane + stride]); } + workgroupBarrier(); + } + maximum = partial[0]; + // All lanes must finish reading the maximum before the scratch array is reused. + workgroupBarrier(); + var total = 0.0; + for (var p = lane; p < 4096u; p += 64u) { total += exp(f32(b0[row * 4096u + p]) - maximum); } + partial[lane] = total; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + total = partial[0]; + for (var p = lane; p < 4096u; p += 64u) { + let i = row * 4096u + p; + out[i] = f32(exp(f32(b0[row * 4096u + p]) - maximum) / total); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e1885827206d969e4d30ba0cbea1254ed34899aa --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 64u) % 4u) * 64u + ((i / 1u) % 64u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2ed956d555ce10ac3e0cfb4ddb36ebd66e887258 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1536u; +if (i >= 1536u) { return; } +out[i] = f32(b0[((i / 512u) % 3u) * 512u + ((i / 512u) % 1u) * 512u + ((i / 16u) % 32u) * 1u + ((i / 1u) % 16u) * 32u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a2aecdb17ed7acc593c2fb1336efc680b5b06fe2 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d418d3ee7df4b3d5c78742deeebd6338ae749b09cf5eadb52cc4e68bbd9ce3fa.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d418d3ee7df4b3d5c78742deeebd6338ae749b09cf5eadb52cc4e68bbd9ce3fa.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a0029935b20700451432632be68176f7c5a1e58c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d418d3ee7df4b3d5c78742deeebd6338ae749b09cf5eadb52cc4e68bbd9ce3fa.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 98304 || token >= 131072) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 98304) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d44354e74d5bfca2fb879607683c5d04cb30c4e1a694270584a01c0c6b3d9be8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d44354e74d5bfca2fb879607683c5d04cb30c4e1a694270584a01c0c6b3d9be8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8dc4e37b9ab18460e2948a94be384c7507b4a40b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d44354e74d5bfca2fb879607683c5d04cb30c4e1a694270584a01c0c6b3d9be8.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 192u; +if (i >= 176u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..953be222dbeeda53732439dbfe62aa874ef12d4f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[0u * 2048u + ((i / 2048u) % 1u) * 2048u + ((i / 32u) % 64u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d8c79a22e83e4a3b75b732bffa9ca673713bb57d580c5af4e59c805645ff1ca3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d8c79a22e83e4a3b75b732bffa9ca673713bb57d580c5af4e59c805645ff1ca3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2b2fd35974b2d0fe841a8a268a0226630737a60e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/d8c79a22e83e4a3b75b732bffa9ca673713bb57d580c5af4e59c805645ff1ca3.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let x = f32(b0[i]); +out[i] = f32(cos(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/da7c63a84d7f2c46e8234a34c0905cfad6229740145070df00819509f8ab39de.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/da7c63a84d7f2c46e8234a34c0905cfad6229740145070df00819509f8ab39de.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..499822f6fd09e951de9b6f6961f497b337bb638b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/da7c63a84d7f2c46e8234a34c0905cfad6229740145070df00819509f8ab39de.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 192u; +if (i >= 192u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/dc4ee648b97b273931e31c95b910d66f11e34a1cb036589e9ae9cc250b6e6291.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/dc4ee648b97b273931e31c95b910d66f11e34a1cb036589e9ae9cc250b6e6291.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0e13dfcb4085c03a943bab386ba2afe5e2a6133c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/dc4ee648b97b273931e31c95b910d66f11e34a1cb036589e9ae9cc250b6e6291.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 4u) { return; } +out[i] = i32(b0[0u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/dd544e5a005b68617e9a3557e1d24dd6282a5a62f47cae4cc41b619d3a1cd603.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/dd544e5a005b68617e9a3557e1d24dd6282a5a62f47cae4cc41b619d3a1cd603.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ea5b4f2a12f5be394f09aff8d9d7d412604cad2b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/dd544e5a005b68617e9a3557e1d24dd6282a5a62f47cae4cc41b619d3a1cd603.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +let batch = i / 2048u; +let row = (i / 64u) % 32u; +let col = i % 64u; +var acc = 0.0; +for (var p = 0u; p < 1u; p++) { + acc += f32(b0[(((batch / 1u) % 3u) * 32u) + row * 1u + p]) * f32(b1[(((batch / 1u) % 3u) * 64u) + p * 64u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/de276eae1430ed164ae977ce4b005301ea0f2652bed1f879acb3a355e600ff5e.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/de276eae1430ed164ae977ce4b005301ea0f2652bed1f879acb3a355e600ff5e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..684e67f205ed8e5d2b379a1b312f0339ea744c07 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/de276eae1430ed164ae977ce4b005301ea0f2652bed1f879acb3a355e600ff5e.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4f2bf7e4c7efd7610ae86a151b04332e7a137cb4 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let x = f32(b0[i]); +out[i] = f32(inverseSqrt(x)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/deb451a300a279d0325fe3be090515d4daae6b3232d87b8e2c050991388ac00f.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/deb451a300a279d0325fe3be090515d4daae6b3232d87b8e2c050991388ac00f.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2373549cc794fa4438a3c1e3ac3320d217d2de1c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/deb451a300a279d0325fe3be090515d4daae6b3232d87b8e2c050991388ac00f.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[2u * 512u + ((i / 512u) % 1u) * 512u + ((i / 32u) % 16u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/deee894ecb86334ff82870260fc5edbc36439c1d3bce09fab5708c03d699b390.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/deee894ecb86334ff82870260fc5edbc36439c1d3bce09fab5708c03d699b390.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..edaf6eca29e64fa2e4a563af4eaf9fe76bfb99b7 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/deee894ecb86334ff82870260fc5edbc36439c1d3bce09fab5708c03d699b390.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 32u) { return; } +out[i] = f32(b0[2u * 32u + ((i / 32u) % 1u) * 32u + ((i / 32u) % 1u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e01dc46d731ca9d3358814482da28b4edb8496243937be85ddde86a02a215169.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e01dc46d731ca9d3358814482da28b4edb8496243937be85ddde86a02a215169.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5bc58ca8a83e46e3403c1f4ea7a6fd95358ac3d0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e01dc46d731ca9d3358814482da28b4edb8496243937be85ddde86a02a215169.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +out[i] = f32(b0[((i / 6144u) % 1u) * 30720u + ((i / 1u) % 6144u) * 5u + (((i / 1u) % 1u) * 1u + 4u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..885220bf8263afb1d19814e4426c6f084bfc769b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl @@ -0,0 +1,34 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 128u; + if (row >= 128u) { return; } + let lane = local.x; + var maximum = -3.4028234663852886e38; + for (var p = lane; p < 4096u; p += 64u) { maximum = max(maximum, f32(b0[row * 4096u + p])); } + partial[lane] = maximum; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] = max(partial[lane], partial[lane + stride]); } + workgroupBarrier(); + } + maximum = partial[0]; + // All lanes must finish reading the maximum before the scratch array is reused. + workgroupBarrier(); + var total = 0.0; + for (var p = lane; p < 4096u; p += 64u) { total += exp(f32(b0[row * 4096u + p]) - maximum); } + partial[lane] = total; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + total = partial[0]; + for (var p = lane; p < 4096u; p += 64u) { + let i = row * 4096u + p; + out[i] = f32(exp(f32(b0[row * 4096u + p]) - maximum) / total); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6e0d70a003b0ae9ebc255496a061f374428e3953 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let x = f32(b0[i]); let s = f32(f32(x / (1.0 + exp(-x)))); +out[i] = f32(s * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e26328df0e65bd3b1aa31d12ed34e71b1b4b309d708bd58badcabad803bca34a.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e26328df0e65bd3b1aa31d12ed34e71b1b4b309d708bd58badcabad803bca34a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..386e724abeb484d12085a13de21550ab9f87e944 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e26328df0e65bd3b1aa31d12ed34e71b1b4b309d708bd58badcabad803bca34a.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +let x = f32(b0[i]); let s = f32(f32(x / (1.0 + exp(-x)))); +out[i] = f32(s * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ea5b4de02c46ed92269369bebfaf9e012b9aa48d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl @@ -0,0 +1,13 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { + let i = gid.x + gid.y * 32768u; + if (i >= 32768u) { return; } + let token = (i / 256u) % 64u; + let outer = i / 16384u; + let destination = outer * 1048576u + u32(b1[token]) * 256u + i % 256u; + out[((destination) / 256u) % 4096u * 512u + ((destination) / 1048576u) % 2u * 256u + ((destination) / 1u) % 256u * 1u] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e38b21c1b50403e478d2d4956df390560aa740de2dcba8d69322d996c998adf4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e38b21c1b50403e478d2d4956df390560aa740de2dcba8d69322d996c998adf4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2eb119d2449221b9b8bace6cfb92a13e33a3c95c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e38b21c1b50403e478d2d4956df390560aa740de2dcba8d69322d996c998adf4.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 4096u + ((i / 2048u) % 1u) * 4096u + ((i / 256u) % 8u) * 512u + (((i / 1u) % 256u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3d2f9b253a6b9d0335cd3b020fa078163eb347a6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 64u) % 16u) * 64u + ((i / 1u) % 64u) * 1u])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e4a989431631a3036d713a383f15805979dcd1650f802ad1bbcee3ffc2d5aa54.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e4a989431631a3036d713a383f15805979dcd1650f802ad1bbcee3ffc2d5aa54.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d4ebe3189f2b2e3713de41d2f071ccdd10bcc858 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e4a989431631a3036d713a383f15805979dcd1650f802ad1bbcee3ffc2d5aa54.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 512u; + if (i >= 512u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 512u) * 2048u + p]) * dequant_1((i % 512u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e6571e9ffa79d4f7888d606a5845a6fe7d39e3b7944eafb979c162a384245c66.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e6571e9ffa79d4f7888d606a5845a6fe7d39e3b7944eafb979c162a384245c66.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1cca9e30814dd2231912899d446310b2c59b8009 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e6571e9ffa79d4f7888d606a5845a6fe7d39e3b7944eafb979c162a384245c66.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 6144u + ((i / 2048u) % 1u) * 6144u + (((i / 1u) % 2048u) * 1u + 4096u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e6b78ab7b0b8ae70ff5c73287337f09473aede8d7740951a4d7518daf36c0601.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e6b78ab7b0b8ae70ff5c73287337f09473aede8d7740951a4d7518daf36c0601.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d6e612ecc4d97bdd2efc9715b2e3e03df417cb44 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e6b78ab7b0b8ae70ff5c73287337f09473aede8d7740951a4d7518daf36c0601.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 16u + row) * 2048u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 16u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 16u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 2048u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 16u && col < 2048u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..46d7c7b355ee64e20cfeead625b246a385c60d9b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 24576u + ((i / 2048u) % 4u) * 6144u + (((i / 1u) % 2048u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e829b3bd2efe5b094dc36238e2a933a1e30c942efddfc80e79862a55c57e6e20.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e829b3bd2efe5b094dc36238e2a933a1e30c942efddfc80e79862a55c57e6e20.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c061788bda0478004560218a522ad6db46d1c40e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e829b3bd2efe5b094dc36238e2a933a1e30c942efddfc80e79862a55c57e6e20.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +var acc = 0.0; +for (var j = 0u; j < 128u; j++) { acc += f32(b0[(((i / 16u) % 1u) * 2048u + ((i / 16u) % 1u) * 2048u + ((i / 1u) % 16u) * 128u) + (((j / 1u) % 128u) * 1u)]); } +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9737295d6a724ac96efb6c84473f524d0f8dcb5f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +out[i] = f32(f32(b0[i]) * 1.0); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e867b978e7008207276fa1603c3c1c968a91d5b02e70daa63b1c9e462b6c36d2.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e867b978e7008207276fa1603c3c1c968a91d5b02e70daa63b1c9e462b6c36d2.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f47eaba34fc23b6975aa31bc0c00044a984a7861 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e867b978e7008207276fa1603c3c1c968a91d5b02e70daa63b1c9e462b6c36d2.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +out[i] = i32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..22f89afc566d4ca07eaa1dbc2cd6483d7a06aa71 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 270336u + ((i / 512u) % 16u) * 16896u + (((i / 128u) % 4u) * 1u + 128u) * 128u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb062a9b5fdad085ac68638dd1218cd210d2aad87bd96e2adf505571076b881b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb062a9b5fdad085ac68638dd1218cd210d2aad87bd96e2adf505571076b881b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..24a471d59389f6343fcc42260b429882b9b4ea1d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb062a9b5fdad085ac68638dd1218cd210d2aad87bd96e2adf505571076b881b.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 98304 || token >= 131072) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 98304) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb52355cc0ef7f698f9c4a5667eb20a31652d69cdab4e0f0774b81464b9528ca.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb52355cc0ef7f698f9c4a5667eb20a31652d69cdab4e0f0774b81464b9528ca.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..631148594b5205f7782a247cc2863912e4061747 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb52355cc0ef7f698f9c4a5667eb20a31652d69cdab4e0f0774b81464b9528ca.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 0 || token >= 32768) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 0) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb77480d0d0529a45f6e0a1967f433c32b47ac7282ccc895f89d076949a71fbf.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb77480d0d0529a45f6e0a1967f433c32b47ac7282ccc895f89d076949a71fbf.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..31fbda7517058b83513ab528298bac318ae476c5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eb77480d0d0529a45f6e0a1967f433c32b47ac7282ccc895f89d076949a71fbf.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 229376 || token >= 248320) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 229376) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ec606c53f8610fff07d8464d8f1cd2a909203cd4064d1be19ad9bdb42263794d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ec606c53f8610fff07d8464d8f1cd2a909203cd4064d1be19ad9bdb42263794d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5d9693423508c7bd74ec4f23c60f4d86602c81e1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ec606c53f8610fff07d8464d8f1cd2a909203cd4064d1be19ad9bdb42263794d.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let batch = i / 256u; +let row = (i / 256u) % 1u; +let col = i % 256u; +var acc = 0.0; +for (var p = 0u; p < 4096u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 4096u) + row * 4096u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 256u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/edfa4ff396bf5cc3be28d9051639c4dda6fec1302d7a2bd34d89ec903af94af1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/edfa4ff396bf5cc3be28d9051639c4dda6fec1302d7a2bd34d89ec903af94af1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fa04fd0adecdb9f18898bad16cb516ccdf4bf468 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/edfa4ff396bf5cc3be28d9051639c4dda6fec1302d7a2bd34d89ec903af94af1.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +out[i] = f32(f32(b0[i]) + (1e-06 * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eea033222d278c8aa8f4b0de36243adba4e5b6ce274d24a3dcd365ad42c19a38.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eea033222d278c8aa8f4b0de36243adba4e5b6ce274d24a3dcd365ad42c19a38.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7dd035a2b7b4ce728303f33a2f815174cbedc865 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/eea033222d278c8aa8f4b0de36243adba4e5b6ce274d24a3dcd365ad42c19a38.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 4096u + ((i / 2048u) % 1u) * 4096u + ((i / 256u) % 8u) * 512u + (((i / 1u) % 256u) * 1u + 256u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..7b1a3f0dff8b91f244bd9f20ffde6873033a24df --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 512u; + if (row >= 512u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 256u; j++) { + let v = f32(b0[row * 256u + j]); + total += v * v; + } + factor = inverseSqrt(total / 256.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 256u; p += 64u) { + let i = row * 256u + p; + out[i] = f32(f32(b0[row * 256u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f3e0c0c3178577855935a47c94b1fbace824ff39 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 16384u; +if (i >= 16384u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/efacc40901cd20fbccdbd5fff0b0b52af2860746708640ae1907d6be212f5f86.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/efacc40901cd20fbccdbd5fff0b0b52af2860746708640ae1907d6be212f5f86.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..02f6f04a8138ab25ae38bf5b35cc13e736f0fffc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/efacc40901cd20fbccdbd5fff0b0b52af2860746708640ae1907d6be212f5f86.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 65536 || token >= 98304) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 65536) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e7ff2c1c7d2a5c72bbf52908e3a4a89766434990 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 704u; +if (i >= 704u) { return; } +out[i] = f32(b0[((i / 704u) % 1u) * 2048u + ((i / 11u) % 64u) * 32u + (((i / 1u) % 11u) * 3u + 1u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f114c5cb9f1a7e377d9a3bcb28ab15b72807ece1796cf9c02fc74e7ce7318cc3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f114c5cb9f1a7e377d9a3bcb28ab15b72807ece1796cf9c02fc74e7ce7318cc3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..71fee4a974a4ef03d91dd3ce0680762c347a9577 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f114c5cb9f1a7e377d9a3bcb28ab15b72807ece1796cf9c02fc74e7ce7318cc3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 16u) { return; } +out[i] = f32(b0[((i / 16u) % 1u) * 16u + ((i / 1u) % 16u) * 1u + 0u * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..63d1ffd2bc103e1a26f56ca1d5c9ff8519c692ac --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let x = f32(b0[i]); +out[i] = f32(1.0 / (1.0 + exp(-x))); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8ea3a882fbad7969825ed46025244690e2dd7b52 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..15382fc197ef648b58ce80bf82efcabed936514c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let coord = (i / 1u) % 256u; +if (coord >= 0u && coord < 64u) { out[i] = f32(b0[(i / 256u) * 64u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 64u && coord < 256u) { out[i] = f32(b1[(i / 256u) * 192u + (coord - 64u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..514e64a95d7576a978b5e3abc375ffb22297bc66 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 32768u + ((i / 1024u) % 8u) * 4096u + ((i / 64u) % 16u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fc2b54d6f71293881b2d717d6b6828fc97173740 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2097152u; +if (i >= 2097152u) { return; } +out[i] = f32(f32(b0[i]) * 0.0625); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f43cdd9c75fc256957b1b144a0587e8c8ddea861f991e1cdb6c9098e8b5d6ed7.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f43cdd9c75fc256957b1b144a0587e8c8ddea861f991e1cdb6c9098e8b5d6ed7.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b2f14ad5c01e9efb2e5f7424d8124543f564a86d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f43cdd9c75fc256957b1b144a0587e8c8ddea861f991e1cdb6c9098e8b5d6ed7.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +out[i] = f32(b0[((i / 64u) % 1u) * 128u + ((i / 32u) % 2u) * 64u + ((i / 32u) % 1u) * 64u + (((i / 1u) % 32u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ce3525f2123ee5d4f25f699881ad39286c38f693 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(f32(b0[i]) * f32(b0[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f51f5d699193197f0dc7c2d586d727e8e41e465e70ef66e208e568c544524cf4.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f51f5d699193197f0dc7c2d586d727e8e41e465e70ef66e208e568c544524cf4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..bf1c1f3bc76577dc8abfe876ebc9e56ca5713ec4 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f51f5d699193197f0dc7c2d586d727e8e41e465e70ef66e208e568c544524cf4.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 18944u; +if (i >= 18944u) { return; } +let coord = (i / 1u) % 18944u; +if (coord >= 0u && coord < 18944u) { out[i] = f32(b0[(i / 18944u) * 18944u + (coord - 0u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..92790934326cbc014348566d54624e3d2d8a85c1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..011b9989a7cfd50ed05b4fbde19f90b64aa84b20 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(f32(b0[i]) * f32(b0[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5f6f056866d42771d34664166a72300424224e9d6bd1d57de1805e7476a2050.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5f6f056866d42771d34664166a72300424224e9d6bd1d57de1805e7476a2050.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4e61151db275d2deac9f983bd165d506d746f384 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f5f6f056866d42771d34664166a72300424224e9d6bd1d57de1805e7476a2050.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[1u * 2048u + ((i / 2048u) % 1u) * 2048u + ((i / 32u) % 64u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f64c470f9333da8111720c1b00d9aa0e63ea21435bba9c9550e93a2c75c639bd.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f64c470f9333da8111720c1b00d9aa0e63ea21435bba9c9550e93a2c75c639bd.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2e8ba1b5d3f7dc878ec29db541ee3133e69dc5ca --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f64c470f9333da8111720c1b00d9aa0e63ea21435bba9c9550e93a2c75c639bd.wgsl @@ -0,0 +1,25 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 18944u; + if (i >= 18944u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 18944u) * 2048u + p]) * unpack_bf16_1((i % 18944u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1fe067e9574b327c21206e0e5535bc398f54ff1b --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +out[i] = f32(f32(b0[((i / 1u) % 16u) * 1u]) * f32(b1[i])); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6af5f79d6fa16007e949c9cac3ac0f2bc1a6910e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4194240u; +if (i >= 8388608u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f73912607dffcf0ee27e9e1e1d342a3bef8f998e02cd06a8352524ef35a96d17.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f73912607dffcf0ee27e9e1e1d342a3bef8f998e02cd06a8352524ef35a96d17.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e5eca2c179c0804dcd0c49c39d7427ce2673747c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f73912607dffcf0ee27e9e1e1d342a3bef8f998e02cd06a8352524ef35a96d17.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let batch = i / 4096u; +let row = (i / 4096u) % 1u; +let col = i % 4096u; +var acc = 0.0; +for (var p = 0u; p < 256u; p++) { + acc += f32(b0[(((batch / 1u) % 8u) * 256u) + row * 256u + p]) * f32(b1[(((batch / 1u) % 8u) * 1048576u) + p * 4096u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f84306aa81033babc4c37ecfb91a411dba2ccee17202615deefb2206add106e2.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f84306aa81033babc4c37ecfb91a411dba2ccee17202615deefb2206add106e2.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..58968344810b5ec1eb718ef062079a8fd93b02a0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f84306aa81033babc4c37ecfb91a411dba2ccee17202615deefb2206add106e2.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +out[i] = f32(b0[((i / 6144u) % 1u) * 6144u + ((i / 1u) % 6144u) * 1u + ((i / 1u) % 1u) * 6144u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..410788b08c259098da3f2a160cb88a04812a90f1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(b0[((i / 32768u) % 1u) * 98304u + ((i / 2048u) % 16u) * 6144u + (((i / 1u) % 2048u) * 1u + 2048u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..9e09a0405b65767fdf150265f0573fa5737b5356 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +out[i] = f32(b0[((i / 6144u) % 1u) * 8192u + ((i / 768u) % 8u) * 1024u + ((i / 192u) % 4u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..cf15e04cdeba75c873e80fc764f945a9f56b3a48 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 8u; + if (row >= 8u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 256u; j++) { + let v = f32(b0[row * 256u + j]); + total += v * v; + } + factor = inverseSqrt(total / 256.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 256u; p += 64u) { + let i = row * 256u + p; + out[i] = f32(f32(b0[row * 256u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c9ea63d0ef2a33525ebd5156d578b4ceaf2ede3f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 8192u + ((i / 2048u) % 4u) * 128u + ((i / 128u) % 16u) * 512u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6f74d6d41b23067fa00cf713cb503945fad5fe53 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 24576u + ((i / 6144u) % 4u) * 1u + ((i / 1u) % 6144u) * 4u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..247b70d7c24a44a2a389531aeedf176cc171389c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 640u; +if (i >= 640u) { return; } +out[i] = f32(b0[((i / 640u) % 1u) * 2048u + ((i / 10u) % 64u) * 32u + (((i / 1u) % 10u) * 3u + 2u) * 1u]); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fe3fa777b524c01e952170bce92075a5187a0830902e76f20a4ed6fe1980a144.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fe3fa777b524c01e952170bce92075a5187a0830902e76f20a4ed6fe1980a144.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..039a58994dd3c0183df120e4ccda77bcd035a817 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/fe3fa777b524c01e952170bce92075a5187a0830902e76f20a4ed6fe1980a144.wgsl @@ -0,0 +1,31 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; +fn dequant_1(index: u32) -> f32 { + let row = index / 2048u; + let col = index % 2048u; + let word = b1[row * 512u + col / 4u]; + let code = i32((word >> ((col % 4u) * 8u)) & 255u) - 128; + return f32(code) * b2[row * 64u + col / 32u]; +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 16u + row) * 6144u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 16u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 16u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 6144u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = dequant_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 16u && col < 6144u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ff97954146b9a2a73ef2cfaa925f51254fc65b4eabcafb4ed57005054acd64b3.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ff97954146b9a2a73ef2cfaa925f51254fc65b4eabcafb4ed57005054acd64b3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5c7c2c92fabaca291cba70c39cae39b764af18d0 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ff97954146b9a2a73ef2cfaa925f51254fc65b4eabcafb4ed57005054acd64b3.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 163840 || token >= 196608) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 163840) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ffd61bbf56bbbbf8d09f9d601173f529b4c4039901ae92ddbbbf3aab411547a1.wgsl b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ffd61bbf56bbbbf8d09f9d601173f529b4c4039901ae92ddbbbf3aab411547a1.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..982996b989eef6315d576f64bbfd0be0f5c74c06 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/kernels/ffd61bbf56bbbbf8d09f9d601173f529b4c4039901ae92ddbbbf3aab411547a1.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 0 || token >= 32768) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 0) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/manifest.json b/qwen35-2b-fp32-int8-g32-home-token-major-v2/manifest.json new file mode 100644 index 0000000000000000000000000000000000000000..6a12cc211b1ebbf3cb898f05be1f48639cbe4caf --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/manifest.json @@ -0,0 +1,2434 @@ +{ + "format": "webtorch", + "version": 1, + "producer": { + "name": "webtorch", + "version": "0.1.0a1", + "torch": "2.14.0" + }, + "entrypoints": { + "forward": "graph.json", + "prefill-4": "entrypoints/prefill-4.json", + "prefill-16": "entrypoints/prefill-16.json", + "prefill-64": "entrypoints/prefill-64.json" + }, + "requiredFeatures": [], + "assets": [ + { + "path": "weights/00000.bin", + "byteLength": 67108864, + "sha256": "84ffbe4377ff841ace0fd11d616bc3466b93dcf57d52517ca8840997f19eb4c6" + }, + { + "path": "weights/00001.bin", + "byteLength": 67108864, + "sha256": "30bde451b91aff2928cffe4865bbc86dbdea76dd6e4af4467d692d3f474a4e8d" + }, + { + "path": "weights/00002.bin", + "byteLength": 67108864, + "sha256": "2a48e75076e26169bd4285f359d0288716ebcdb123b1f79ebe66d7744e74ecc4" + }, + { + "path": "weights/00003.bin", + "byteLength": 67108864, + "sha256": "d586da92796726ab87caabd21324b47f5332b0daad223a1322d1a5e75a276489" + }, + { + "path": "weights/00004.bin", + "byteLength": 67108864, + "sha256": "8615920b4bd70b2e1c379f78d8fd2a3b454d7e1aa4db6ce5fda24b64e0b57c3a" + }, + { + "path": "weights/00005.bin", + "byteLength": 67108864, + "sha256": "5da61ce89024c8030b4efb637f69cdb77189724dcd9f7da9b987a7fb92a510a9" + }, + { + "path": "weights/00006.bin", + "byteLength": 67108864, + "sha256": "213bb58a0acf92bc272be0a009c1c660375cfcbea1525ef81a191efcd3a32ee0" + }, + { + "path": "weights/00007.bin", + "byteLength": 67108864, + "sha256": "e48c21b8fd01fd6eee6b534eba62c0c7285963b5c18391b1c854fbfee0c0c21b" + }, + { + "path": "weights/00008.bin", + "byteLength": 67108864, + "sha256": "b45e3336fac9353a2b90a731184c0a725fe0bf4b4f6c1cdcfd5d4e2d8f5f3849" + }, + { + "path": "weights/00009.bin", + "byteLength": 67108864, + "sha256": "097d3ef6aed94a420d026323d9e43f07730289dd1a9fe22bdeae57d76b84f0b6" + }, + { + "path": "weights/00010.bin", + "byteLength": 67108864, + "sha256": "e1b9904b4ef7840fedc8badd04438db0d7b9e7baadafe8931534c8801438a11f" + }, + { + "path": "weights/00011.bin", + "byteLength": 67108864, + "sha256": "7b52d09d0ce3fa311c4e08c9e6aded6bd20d221461f44aa6305a39e9c098b578" + }, + { + "path": "weights/00012.bin", + "byteLength": 67108864, + "sha256": "5193cee36808d007e7b7bdd958e49c0a3c30f99be53cdc163396553201b7a652" + }, + { + "path": "weights/00013.bin", + "byteLength": 67108864, + "sha256": "5c82b1141090140d5899e34a0d87c3d4f570a5e1d92d39f2c7adb0ae49aacdef" + }, + { + "path": "weights/00014.bin", + "byteLength": 67108864, + "sha256": "bea09d102c10e33637d240a9e420c57bcb5cbf2d241c05ae2b07cf5ac0984b4d" + }, + { + "path": "weights/00015.bin", + "byteLength": 67108864, + "sha256": "e03e9ea691d0b5ceeb2fe8b5be66d5c093e844e9a9c66419d39b5896b4e01319" + }, + { + "path": "weights/00016.bin", + "byteLength": 67108864, + "sha256": "fe8254c59393a562809ecd57c8aa80b009fc6ebe2eadc434582a4f2747eaeb65" + }, + { + "path": "weights/00017.bin", + "byteLength": 67108864, + "sha256": "57148cd4031dbb9e4c797bec29e94bce34196bd99cc466caf4f473994c3cfb37" + }, + { + "path": "weights/00018.bin", + "byteLength": 67108864, + "sha256": "e4de09f17f8c15e27c06eaaf2e69885efd837192a5d14a0d5a99c93d516faf5f" + }, + { + "path": "weights/00019.bin", + "byteLength": 67108864, + "sha256": "76dda70376dfa5539aa9adf093bbe00f1c91b9b621c314764d334a162f7d103b" + }, + { + "path": "weights/00020.bin", + "byteLength": 67108864, + "sha256": "839854fef54645505fdb821f02eccc9cc4755c21cf4fde4b2a3692c33a59a05a" + }, + { + "path": "weights/00021.bin", + "byteLength": 67108864, + "sha256": "da273605fc35f886d3ec8cc88e6d84be37e32dfc267b81d7bcbdbf6506bbb514" + }, + { + "path": "weights/00022.bin", + "byteLength": 67108864, + "sha256": "3398ef4c2270c78071273def3c5b519e7651b98cd19be8d9745f5b7b86fcf810" + }, + { + "path": "weights/00023.bin", + "byteLength": 67108864, + "sha256": "c457d355150fa70df57f93ed3f089e73cefec891058b04a470a18d033e1ceed2" + }, + { + "path": "weights/00024.bin", + "byteLength": 67108864, + "sha256": "74aecb320090f02b1f1b77dad4f84befcbfa55c85ff55e456f349ef2a29bbd9b" + }, + { + "path": "weights/00025.bin", + "byteLength": 67108864, + "sha256": "a61b2a95ceb63bc80bbc226deb31bb8e12f9b714edfcfa4e49af5132a49fbb31" + }, + { + "path": "weights/00026.bin", + "byteLength": 67108864, + "sha256": "2d6ffa605c0cde049237233841ebe39208460711fd19f719923c964d049fe8be" + }, + { + "path": "weights/00027.bin", + "byteLength": 67108864, + "sha256": "28cf84c4ab75575f251099f433618050dfd28f4866d39dfac450beaf6af020d4" + }, + { + "path": "weights/00028.bin", + "byteLength": 67108864, + "sha256": "6c42953eecb293a4bcf06d43804e72eaa01b4e38e90fe4f6d218f9941068169d" + }, + { + "path": "weights/00029.bin", + "byteLength": 67108864, + "sha256": "e2aae91d0dc2c6391ee39ef03769370eb3d2c91ecd98bc4a5d6035452ef15204" + }, + { + "path": "weights/00030.bin", + "byteLength": 67108864, + "sha256": "ccf4f0815f5dcd4cf81d97e45d962e3b42f19c8126f1eba098919b07f6805b01" + }, + { + "path": "weights/00031.bin", + "byteLength": 67108864, + "sha256": "f2314e1a9519f3bad9f55abd2c3cbea7406dc112aa43cc1aea123d1e60b21371" + }, + { + "path": "weights/00032.bin", + "byteLength": 67108864, + "sha256": "be9ecb7b60b27697aec52b3c8745ba4f836c5e7942cb20b4c0dd8bb7529d8119" + }, + { + "path": "weights/00033.bin", + "byteLength": 67108864, + "sha256": "3d425053cc8ffcee7b92b4e680eb7b562c31759e39d71c64a02348a36bed6e4b" + }, + { + "path": "weights/00034.bin", + "byteLength": 67108864, + "sha256": "18e6bbaa9d1daa2888815ec2d86db4151750a0870ad08ef54d44e85842f4576a" + }, + { + "path": "weights/00035.bin", + "byteLength": 67108864, + "sha256": "11fc5d9bbf3010c3e57912f00b8c246d4b7654e7cde4b77408a5fc868eb1e52e" + }, + { + "path": "weights/00036.bin", + "byteLength": 67108864, + "sha256": "0d2e2c6008d5e0845937200ef339063e112f493c1d8b48a74feec08061e46560" + }, + { + "path": "weights/00037.bin", + "byteLength": 67108864, + "sha256": "212cd04a4207e70cb999d92ac1682fef04a0da2d03954b07de7f0451c27dbcc2" + }, + { + "path": "weights/00038.bin", + "byteLength": 13483392, + "sha256": "4d3e63880b48456dcf9e9cae7a12838af3d04ad01c6ef352a7ad77d9e01c9d63" + }, + { + "path": "tokenizer/tokenizer.json", + "byteLength": 12807982, + "sha256": "5f9e4d4901a92b997e463c1f46055088b6cca5ca61a6522d1b9f64c4bb81cb42" + }, + { + "path": "tokenizer/tokenizer_config.json", + "byteLength": 16709, + "sha256": "49e2b6e395f959f077f1e992b338919c0d4a9732fc6e613995e06557f843500c" + }, + { + "path": "tokenizer/chat_template.jinja", + "byteLength": 7755, + "sha256": "273d8e0e683b885071fb17e08d71e5f2a5ddfb5309756181681de4f5a1822d80" + }, + { + "path": "source/config.json", + "byteLength": 2908, + "sha256": "ed1c1723241f23f7f4e23430759cbd7dcfb4103cbdfe052bfe7626b57c2615b4" + }, + { + "path": "source/LICENSE", + "byteLength": 11544, + "sha256": "bbedc3fda3305820b977265f01b8619d87570a6739de3a5582c3464840f1e57a" + }, + { + "path": "source/provenance.json", + "byteLength": 199, + "sha256": "c8660f24d71eae596fa20ba3312e0a3634dea45d9081186ca3c95543bb94ccdd" + }, + { + "path": "entrypoints/prefill-16.json", + "byteLength": 8300908, + "sha256": "75f4969ac7224a86fa5b866b98a4acf3fff006256a58fcad0afcf91bd2e6b808" + }, + { + "path": "entrypoints/prefill-4.json", + "byteLength": 8297097, + "sha256": "6634066d0fd9fb90c8b65437751552d4a54372c93a8e44e34883033b5d40f726" + }, + { + "path": "entrypoints/prefill-64.json", + "byteLength": 8302535, + "sha256": "5eabf4312374292c840fc03273cd660895bdedc294425d9a1fb2ee153fc126c2" + }, + { + "path": "graph.json", + "byteLength": 10773173, + "sha256": "8b59d388371c8b763ec79a79a420e00ab83ff9ff8250ad1d08b696343da2f050" + }, + { + "path": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl", + "byteLength": 373, + "sha256": "0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52" + }, + { + "path": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl", + "byteLength": 849, + "sha256": "0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4" + }, + { + "path": "kernels/0337d8a473b6e485bd383533df7d373dbbfe7a5f3a982424004560b7213fbaa3.wgsl", + "byteLength": 499, + "sha256": "0337d8a473b6e485bd383533df7d373dbbfe7a5f3a982424004560b7213fbaa3" + }, + { + "path": "kernels/04f26661cc9ac73bb7f39f66b76c4be31ee8774e094eeb41ed7d677e1b1d3fa9.wgsl", + "byteLength": 368, + "sha256": "04f26661cc9ac73bb7f39f66b76c4be31ee8774e094eeb41ed7d677e1b1d3fa9" + }, + { + "path": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl", + "byteLength": 371, + "sha256": "04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0" + }, + { + "path": "kernels/0554a443ecf6ead32fd2d58178b9ce3c592c89a09b3f63fa509ee947323bb497.wgsl", + "byteLength": 399, + "sha256": "0554a443ecf6ead32fd2d58178b9ce3c592c89a09b3f63fa509ee947323bb497" + }, + { + "path": "kernels/06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992.wgsl", + "byteLength": 394, + "sha256": "06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992" + }, + { + "path": "kernels/0725908abf78c022f86deb338a06779f6f1346ebfe54ff5a43ee6b9eeb93c972.wgsl", + "byteLength": 286, + "sha256": "0725908abf78c022f86deb338a06779f6f1346ebfe54ff5a43ee6b9eeb93c972" + }, + { + "path": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl", + "byteLength": 307, + "sha256": "07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d" + }, + { + "path": "kernels/0835fa80eaadb7c0e6d677e1fc622ad5dcedabb431e5d312f3b7aeb2252a7c7c.wgsl", + "byteLength": 231, + "sha256": "0835fa80eaadb7c0e6d677e1fc622ad5dcedabb431e5d312f3b7aeb2252a7c7c" + }, + { + "path": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl", + "byteLength": 758, + "sha256": "08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a" + }, + { + "path": "kernels/087fe4a47ab2de93b999a0e519015c12450bf97fb81683d317c894b2bd555169.wgsl", + "byteLength": 595, + "sha256": "087fe4a47ab2de93b999a0e519015c12450bf97fb81683d317c894b2bd555169" + }, + { + "path": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl", + "byteLength": 317, + "sha256": "09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b" + }, + { + "path": "kernels/0b8815b1efe176d55ab08530c0a9e1913cf6c9ef3e773c574843573d237cf196.wgsl", + "byteLength": 309, + "sha256": "0b8815b1efe176d55ab08530c0a9e1913cf6c9ef3e773c574843573d237cf196" + }, + { + "path": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl", + "byteLength": 311, + "sha256": "0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56" + }, + { + "path": "kernels/0bfd7013b3bf9735b02307e5f8a0fd16da7d84f8cb1acd4e2638a589de1c2efa.wgsl", + "byteLength": 1523, + "sha256": "0bfd7013b3bf9735b02307e5f8a0fd16da7d84f8cb1acd4e2638a589de1c2efa" + }, + { + "path": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl", + "byteLength": 411, + "sha256": "0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69" + }, + { + "path": "kernels/0d3892883d1532d173a7dbe85d9ab1daa87f0d9b4923a535b8d2003f24f9500c.wgsl", + "byteLength": 497, + "sha256": "0d3892883d1532d173a7dbe85d9ab1daa87f0d9b4923a535b8d2003f24f9500c" + }, + { + "path": "kernels/0dd6f37ccecd061f54f54926f7a97a97c9b7d02d77fef595526180b491550210.wgsl", + "byteLength": 1517, + "sha256": "0dd6f37ccecd061f54f54926f7a97a97c9b7d02d77fef595526180b491550210" + }, + { + "path": "kernels/0e5468583a1ba929483119c50d4be42a58aed4dde1e15cc231908ed7543d0b71.wgsl", + "byteLength": 288, + "sha256": "0e5468583a1ba929483119c50d4be42a58aed4dde1e15cc231908ed7543d0b71" + }, + { + "path": "kernels/0e5e44ae1adc5e11bf41b230e4ab1f93b5c0bd79b4f4e28e205d02cae01cebd0.wgsl", + "byteLength": 663, + "sha256": "0e5e44ae1adc5e11bf41b230e4ab1f93b5c0bd79b4f4e28e205d02cae01cebd0" + }, + { + "path": "kernels/0e9b6ee5f92769faaee5c746d1a3b936cdb7731f3f8e70cbf0a3fe96f6c8d921.wgsl", + "byteLength": 397, + "sha256": "0e9b6ee5f92769faaee5c746d1a3b936cdb7731f3f8e70cbf0a3fe96f6c8d921" + }, + { + "path": "kernels/0f466ed2664d77386f48afd19d8ab2734312bfd4f5f4d5b063d801a0b0a97cd9.wgsl", + "byteLength": 396, + "sha256": "0f466ed2664d77386f48afd19d8ab2734312bfd4f5f4d5b063d801a0b0a97cd9" + }, + { + "path": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl", + "byteLength": 386, + "sha256": "0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5" + }, + { + "path": "kernels/0fa78dd7a41f9816e0a051fa3076f0ee2d258ff73d4e66a1360a492cb2e924d6.wgsl", + "byteLength": 667, + "sha256": "0fa78dd7a41f9816e0a051fa3076f0ee2d258ff73d4e66a1360a492cb2e924d6" + }, + { + "path": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl", + "byteLength": 411, + "sha256": "0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d" + }, + { + "path": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl", + "byteLength": 1388, + "sha256": "102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780" + }, + { + "path": "kernels/11a92e9cba6bfc381c98c5127db137639d6c87f1cb220459880ead039dc81256.wgsl", + "byteLength": 363, + "sha256": "11a92e9cba6bfc381c98c5127db137639d6c87f1cb220459880ead039dc81256" + }, + { + "path": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl", + "byteLength": 381, + "sha256": "121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483" + }, + { + "path": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl", + "byteLength": 290, + "sha256": "12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df" + }, + { + "path": "kernels/1255847146b31732939e573cdb26c483358c1ce07f987bd8c3d3d69ae8c7e141.wgsl", + "byteLength": 380, + "sha256": "1255847146b31732939e573cdb26c483358c1ce07f987bd8c3d3d69ae8c7e141" + }, + { + "path": "kernels/12a3ca6d870effe047b995842c9d7d237759405513848049f5c4dfd99f5e3db5.wgsl", + "byteLength": 1511, + "sha256": "12a3ca6d870effe047b995842c9d7d237759405513848049f5c4dfd99f5e3db5" + }, + { + "path": "kernels/13237b557466d2fef5bfbc74e7ac77219b9821a53bc0843dbb5d14db8b04d414.wgsl", + "byteLength": 308, + "sha256": "13237b557466d2fef5bfbc74e7ac77219b9821a53bc0843dbb5d14db8b04d414" + }, + { + "path": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl", + "byteLength": 2298, + "sha256": "1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62" + }, + { + "path": "kernels/13dc73935b9b3b978232043e13babee3877bd53ca572be440de0590dacce8b17.wgsl", + "byteLength": 367, + "sha256": "13dc73935b9b3b978232043e13babee3877bd53ca572be440de0590dacce8b17" + }, + { + "path": "kernels/1545025e0a625ccc73b42ae112c6f9d78a1504c10b759979ae2247984f25f056.wgsl", + "byteLength": 551, + "sha256": "1545025e0a625ccc73b42ae112c6f9d78a1504c10b759979ae2247984f25f056" + }, + { + "path": "kernels/16beb71877bd6b31cd089e317b806dca308ad54fa19468385c974bac2cafc5d8.wgsl", + "byteLength": 1515, + "sha256": "16beb71877bd6b31cd089e317b806dca308ad54fa19468385c974bac2cafc5d8" + }, + { + "path": "kernels/17b972f97cc2659712ca7c658cd186e851a248115f83a893a8a11f34b441367e.wgsl", + "byteLength": 662, + "sha256": "17b972f97cc2659712ca7c658cd186e851a248115f83a893a8a11f34b441367e" + }, + { + "path": "kernels/17ec6bdaf98edf7657b74a25036c2bec806ecbb4280f33fff6afd2e0de5ed377.wgsl", + "byteLength": 317, + "sha256": "17ec6bdaf98edf7657b74a25036c2bec806ecbb4280f33fff6afd2e0de5ed377" + }, + { + "path": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl", + "byteLength": 396, + "sha256": "18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea" + }, + { + "path": "kernels/18a66ec0875c456c9defd45d15e6ef0c148e64a1618e2825c7f96eadbbe8303a.wgsl", + "byteLength": 286, + "sha256": "18a66ec0875c456c9defd45d15e6ef0c148e64a1618e2825c7f96eadbbe8303a" + }, + { + "path": "kernels/18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb.wgsl", + "byteLength": 369, + "sha256": "18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb" + }, + { + "path": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl", + "byteLength": 379, + "sha256": "19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d" + }, + { + "path": "kernels/1a73b6fceda28f40bba4ae27a986ffa39842db94fa5903ea5bf689a7e854d4f3.wgsl", + "byteLength": 499, + "sha256": "1a73b6fceda28f40bba4ae27a986ffa39842db94fa5903ea5bf689a7e854d4f3" + }, + { + "path": "kernels/1ad205080cae29142a3ad87343a0cf3ac4945455398293946110d421ce6d515e.wgsl", + "byteLength": 371, + "sha256": "1ad205080cae29142a3ad87343a0cf3ac4945455398293946110d421ce6d515e" + }, + { + "path": "kernels/1b9f4e330debc7235cfaf8f51d00fec575e09aa6116a45ea001e10ff5f09eb8c.wgsl", + "byteLength": 581, + "sha256": "1b9f4e330debc7235cfaf8f51d00fec575e09aa6116a45ea001e10ff5f09eb8c" + }, + { + "path": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl", + "byteLength": 406, + "sha256": "1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0" + }, + { + "path": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl", + "byteLength": 758, + "sha256": "1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb" + }, + { + "path": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl", + "byteLength": 386, + "sha256": "20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755" + }, + { + "path": "kernels/20fb9e0d0bd2aab34b7f69eac259898e68cac4a0d6b0bda5e95c9126a660336d.wgsl", + "byteLength": 395, + "sha256": "20fb9e0d0bd2aab34b7f69eac259898e68cac4a0d6b0bda5e95c9126a660336d" + }, + { + "path": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl", + "byteLength": 308, + "sha256": "21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de" + }, + { + "path": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl", + "byteLength": 410, + "sha256": "2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d" + }, + { + "path": "kernels/222a2645e3e02d0a4063a63ca1b6fa4c89faee6b76905b20de4dd54ab3077ea3.wgsl", + "byteLength": 285, + "sha256": "222a2645e3e02d0a4063a63ca1b6fa4c89faee6b76905b20de4dd54ab3077ea3" + }, + { + "path": "kernels/228e9c354122040cd7c70f0bcd9445c92011bf85343add619aeb51846c885636.wgsl", + "byteLength": 286, + "sha256": "228e9c354122040cd7c70f0bcd9445c92011bf85343add619aeb51846c885636" + }, + { + "path": "kernels/234987ec68497956ea7aef8e3f44c8a73dbe4c1519165d123946bedbb4d18e26.wgsl", + "byteLength": 380, + "sha256": "234987ec68497956ea7aef8e3f44c8a73dbe4c1519165d123946bedbb4d18e26" + }, + { + "path": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl", + "byteLength": 310, + "sha256": "237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a" + }, + { + "path": "kernels/242b7d51c19c9857a096c2ae1f7b72ebd410100a1542c51390950adbb8aed35c.wgsl", + "byteLength": 660, + "sha256": "242b7d51c19c9857a096c2ae1f7b72ebd410100a1542c51390950adbb8aed35c" + }, + { + "path": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl", + "byteLength": 847, + "sha256": "246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4" + }, + { + "path": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl", + "byteLength": 417, + "sha256": "2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e" + }, + { + "path": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl", + "byteLength": 428, + "sha256": "2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6" + }, + { + "path": "kernels/26cf6eb3b486d1652247ff130b05ed0e8c8560028eeba59acfc075b976bfdfce.wgsl", + "byteLength": 549, + "sha256": "26cf6eb3b486d1652247ff130b05ed0e8c8560028eeba59acfc075b976bfdfce" + }, + { + "path": "kernels/2711a4a396071f4e99303d01d4854ccaa37a445f4b718ebd7b61cf1c37e56b48.wgsl", + "byteLength": 355, + "sha256": "2711a4a396071f4e99303d01d4854ccaa37a445f4b718ebd7b61cf1c37e56b48" + }, + { + "path": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl", + "byteLength": 396, + "sha256": "2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf" + }, + { + "path": "kernels/28119aa01122c42bd26ceb37129fe0c95b2a9192163f6dabd90fe058b1e14c54.wgsl", + "byteLength": 311, + "sha256": "28119aa01122c42bd26ceb37129fe0c95b2a9192163f6dabd90fe058b1e14c54" + }, + { + "path": "kernels/2927b33e105f6ccb9c4352ebdf028ea856d0f47c23a7f6cb140d5acb45356c35.wgsl", + "byteLength": 667, + "sha256": "2927b33e105f6ccb9c4352ebdf028ea856d0f47c23a7f6cb140d5acb45356c35" + }, + { + "path": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl", + "byteLength": 387, + "sha256": "2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27" + }, + { + "path": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl", + "byteLength": 419, + "sha256": "2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403" + }, + { + "path": "kernels/2b9e4b05ef5623d721dbe56b5812e551efcc6fd833d81064320e86fe94d8c670.wgsl", + "byteLength": 301, + "sha256": "2b9e4b05ef5623d721dbe56b5812e551efcc6fd833d81064320e86fe94d8c670" + }, + { + "path": "kernels/2bdeb3590b1ba05cf6e9c7e8245f8aa552a12dae84f9578c603c9cee081a82d4.wgsl", + "byteLength": 847, + "sha256": "2bdeb3590b1ba05cf6e9c7e8245f8aa552a12dae84f9578c603c9cee081a82d4" + }, + { + "path": "kernels/2c0cca2a7b0198c317e68992e64f3fe9bba80b67204c2695c20c372471c150d3.wgsl", + "byteLength": 473, + "sha256": "2c0cca2a7b0198c317e68992e64f3fe9bba80b67204c2695c20c372471c150d3" + }, + { + "path": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl", + "byteLength": 410, + "sha256": "2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222" + }, + { + "path": "kernels/2c81f71954e9a2503ae8f3d84f319ffe366cdbb428ab45c22bddee91751c035c.wgsl", + "byteLength": 597, + "sha256": "2c81f71954e9a2503ae8f3d84f319ffe366cdbb428ab45c22bddee91751c035c" + }, + { + "path": "kernels/2cd4a533d32097a17641196f0cd315d170c587bc2b1c62b42b79d566d6fbf140.wgsl", + "byteLength": 386, + "sha256": "2cd4a533d32097a17641196f0cd315d170c587bc2b1c62b42b79d566d6fbf140" + }, + { + "path": "kernels/2dd29b61b039fcdd7fbc3c94f629b24b6f81aa5b9923098837597359b295e40d.wgsl", + "byteLength": 396, + "sha256": "2dd29b61b039fcdd7fbc3c94f629b24b6f81aa5b9923098837597359b295e40d" + }, + { + "path": "kernels/2e1ce6ef01198780289fd4a35d8f86b5172595ed189cf931e8444091d49e8d3a.wgsl", + "byteLength": 297, + "sha256": "2e1ce6ef01198780289fd4a35d8f86b5172595ed189cf931e8444091d49e8d3a" + }, + { + "path": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl", + "byteLength": 429, + "sha256": "2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3" + }, + { + "path": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl", + "byteLength": 409, + "sha256": "2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8" + }, + { + "path": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl", + "byteLength": 421, + "sha256": "3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb" + }, + { + "path": "kernels/309f1b67894a30dd3e88cd18af63ffc51e384b6891b5f34dd1a0588344188f6e.wgsl", + "byteLength": 662, + "sha256": "309f1b67894a30dd3e88cd18af63ffc51e384b6891b5f34dd1a0588344188f6e" + }, + { + "path": "kernels/3203e08f2c99fa4848f553739b7115a7c677840344f17b1d4391d6130517f5a7.wgsl", + "byteLength": 285, + "sha256": "3203e08f2c99fa4848f553739b7115a7c677840344f17b1d4391d6130517f5a7" + }, + { + "path": "kernels/32a5027cac5dd969d63fe5d5c88d7c87abb600c43ad1d70e1c56615ea781eff3.wgsl", + "byteLength": 422, + "sha256": "32a5027cac5dd969d63fe5d5c88d7c87abb600c43ad1d70e1c56615ea781eff3" + }, + { + "path": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl", + "byteLength": 468, + "sha256": "32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181" + }, + { + "path": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl", + "byteLength": 411, + "sha256": "33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba" + }, + { + "path": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl", + "byteLength": 394, + "sha256": "3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b" + }, + { + "path": "kernels/359d61f2ba174e54e2a0920fcf61e84e436fd3eaf7e2832e21fdb24094493667.wgsl", + "byteLength": 553, + "sha256": "359d61f2ba174e54e2a0920fcf61e84e436fd3eaf7e2832e21fdb24094493667" + }, + { + "path": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl", + "byteLength": 853, + "sha256": "35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11" + }, + { + "path": "kernels/360a02a53c176d885331b307a6972d974ce5c8dad0d961b8521c6fd8b37d7ebe.wgsl", + "byteLength": 660, + "sha256": "360a02a53c176d885331b307a6972d974ce5c8dad0d961b8521c6fd8b37d7ebe" + }, + { + "path": "kernels/3612e5e8583c88858acf8b9868817b59e590adc115964205d24b5ce23659916d.wgsl", + "byteLength": 1521, + "sha256": "3612e5e8583c88858acf8b9868817b59e590adc115964205d24b5ce23659916d" + }, + { + "path": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl", + "byteLength": 415, + "sha256": "3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd" + }, + { + "path": "kernels/36c55d910d6fdaf8d3a2bba5a559bf7dcf54364986a7f2c0610b523600667d91.wgsl", + "byteLength": 1477, + "sha256": "36c55d910d6fdaf8d3a2bba5a559bf7dcf54364986a7f2c0610b523600667d91" + }, + { + "path": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl", + "byteLength": 406, + "sha256": "3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf" + }, + { + "path": "kernels/38bd527686bcade9ed19a52788ccd711ca668e76854cc6274c480860fce88ff2.wgsl", + "byteLength": 382, + "sha256": "38bd527686bcade9ed19a52788ccd711ca668e76854cc6274c480860fce88ff2" + }, + { + "path": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl", + "byteLength": 413, + "sha256": "39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851" + }, + { + "path": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl", + "byteLength": 411, + "sha256": "39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc" + }, + { + "path": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl", + "byteLength": 417, + "sha256": "3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66" + }, + { + "path": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl", + "byteLength": 377, + "sha256": "3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d" + }, + { + "path": "kernels/3b2b13d75a6ce00e35c674883bbf1969555c8fc9e088e7d2003a5ea57b4552ff.wgsl", + "byteLength": 1478, + "sha256": "3b2b13d75a6ce00e35c674883bbf1969555c8fc9e088e7d2003a5ea57b4552ff" + }, + { + "path": "kernels/3b8210d9acf57a3c1cca9e926547520d5994967f27ce92897a15b14137f7da66.wgsl", + "byteLength": 373, + "sha256": "3b8210d9acf57a3c1cca9e926547520d5994967f27ce92897a15b14137f7da66" + }, + { + "path": "kernels/3bb850bda95bf77706a2839616a401b773f9de0428d1b427e61fb04e2c35fe74.wgsl", + "byteLength": 493, + "sha256": "3bb850bda95bf77706a2839616a401b773f9de0428d1b427e61fb04e2c35fe74" + }, + { + "path": "kernels/3caf74924884e14997a7fcbb2625a36e3b8a2bcf92da835bf6f787ddae437cdb.wgsl", + "byteLength": 306, + "sha256": "3caf74924884e14997a7fcbb2625a36e3b8a2bcf92da835bf6f787ddae437cdb" + }, + { + "path": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl", + "byteLength": 417, + "sha256": "3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73" + }, + { + "path": "kernels/3daeb9cba5c07ed47ac55e1c2565aa82f7d8e8409037707e7339d1d96d122144.wgsl", + "byteLength": 553, + "sha256": "3daeb9cba5c07ed47ac55e1c2565aa82f7d8e8409037707e7339d1d96d122144" + }, + { + "path": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl", + "byteLength": 309, + "sha256": "3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe" + }, + { + "path": "kernels/3f89d19bd6791657fa702ad00a0517b5f292dbf7d0c196bd5b21c949476d23fd.wgsl", + "byteLength": 497, + "sha256": "3f89d19bd6791657fa702ad00a0517b5f292dbf7d0c196bd5b21c949476d23fd" + }, + { + "path": "kernels/3fa1efae6d90015ba69cb40cef009f49ad7f7a960018fb92a962707deff4f09e.wgsl", + "byteLength": 286, + "sha256": "3fa1efae6d90015ba69cb40cef009f49ad7f7a960018fb92a962707deff4f09e" + }, + { + "path": "kernels/3fa622a834e456fdb19b07df0a199659495aef231294b3bf3123a067c611f13a.wgsl", + "byteLength": 1521, + "sha256": "3fa622a834e456fdb19b07df0a199659495aef231294b3bf3123a067c611f13a" + }, + { + "path": "kernels/3fea2ac7546eb13332dd11cb7001141e5e06137f7b0b40b5bcf3eaae43278b6e.wgsl", + "byteLength": 1029, + "sha256": "3fea2ac7546eb13332dd11cb7001141e5e06137f7b0b40b5bcf3eaae43278b6e" + }, + { + "path": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl", + "byteLength": 410, + "sha256": "40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d" + }, + { + "path": "kernels/416348e2f9aab462c4ea190374014f09c7fd3114626ee3f48fb39a096fceab7a.wgsl", + "byteLength": 652, + "sha256": "416348e2f9aab462c4ea190374014f09c7fd3114626ee3f48fb39a096fceab7a" + }, + { + "path": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl", + "byteLength": 605, + "sha256": "429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221" + }, + { + "path": "kernels/42c5af4838daf75fff9d4bb9a5df409511c1d6daed617d05eaf033a977503eac.wgsl", + "byteLength": 548, + "sha256": "42c5af4838daf75fff9d4bb9a5df409511c1d6daed617d05eaf033a977503eac" + }, + { + "path": "kernels/4365c6a2818dc6f2b29aa9a1994d3ff2a44af72e3e9276e92e927705e2bbea3e.wgsl", + "byteLength": 663, + "sha256": "4365c6a2818dc6f2b29aa9a1994d3ff2a44af72e3e9276e92e927705e2bbea3e" + }, + { + "path": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl", + "byteLength": 417, + "sha256": "4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36" + }, + { + "path": "kernels/4540d87eaec90c9eb42badfe0abfa70252f26b6e7de4dd31ee6903fe50e96bd1.wgsl", + "byteLength": 377, + "sha256": "4540d87eaec90c9eb42badfe0abfa70252f26b6e7de4dd31ee6903fe50e96bd1" + }, + { + "path": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl", + "byteLength": 365, + "sha256": "45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10" + }, + { + "path": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl", + "byteLength": 421, + "sha256": "466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0" + }, + { + "path": "kernels/48608b2b7bfbe0b65d9e2d82a94a76683315421acb1bf168b4baf14a3c139f76.wgsl", + "byteLength": 288, + "sha256": "48608b2b7bfbe0b65d9e2d82a94a76683315421acb1bf168b4baf14a3c139f76" + }, + { + "path": "kernels/48ec6f5173dcab06386f158b26dfbecfb5022f620fa9588a9cb947664b01037e.wgsl", + "byteLength": 598, + "sha256": "48ec6f5173dcab06386f158b26dfbecfb5022f620fa9588a9cb947664b01037e" + }, + { + "path": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl", + "byteLength": 294, + "sha256": "4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1" + }, + { + "path": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl", + "byteLength": 307, + "sha256": "4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426" + }, + { + "path": "kernels/4ac112c035a1a4a2f5deae66fac0969000c4666730c2d7b15cb15a157ea0e9b8.wgsl", + "byteLength": 395, + "sha256": "4ac112c035a1a4a2f5deae66fac0969000c4666730c2d7b15cb15a157ea0e9b8" + }, + { + "path": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl", + "byteLength": 394, + "sha256": "4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba" + }, + { + "path": "kernels/4b1a7529fd5c57d5d4593d4af58a9a3b545c7d106d18251f6452f8a562b97952.wgsl", + "byteLength": 389, + "sha256": "4b1a7529fd5c57d5d4593d4af58a9a3b545c7d106d18251f6452f8a562b97952" + }, + { + "path": "kernels/4bc000a71d644922d2fb4359208765fc904f7fa04ebc2469ef904a3c7e6c1ae3.wgsl", + "byteLength": 1521, + "sha256": "4bc000a71d644922d2fb4359208765fc904f7fa04ebc2469ef904a3c7e6c1ae3" + }, + { + "path": "kernels/4be963f9a4bb928764fd0efe02769e220b0e69defb2f8b22ab28e41a90d3fc14.wgsl", + "byteLength": 286, + "sha256": "4be963f9a4bb928764fd0efe02769e220b0e69defb2f8b22ab28e41a90d3fc14" + }, + { + "path": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl", + "byteLength": 2305, + "sha256": "4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433" + }, + { + "path": "kernels/4d3e5f3a99a6c8c9dba5de30be4302f1e442f91d097437e825df97017e389a42.wgsl", + "byteLength": 367, + "sha256": "4d3e5f3a99a6c8c9dba5de30be4302f1e442f91d097437e825df97017e389a42" + }, + { + "path": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl", + "byteLength": 549, + "sha256": "4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5" + }, + { + "path": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl", + "byteLength": 413, + "sha256": "4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0" + }, + { + "path": "kernels/4f27100b1e707c866f7cdd701f722bed2969be6e71245d4e4a14e1ef7ebe3fcf.wgsl", + "byteLength": 667, + "sha256": "4f27100b1e707c866f7cdd701f722bed2969be6e71245d4e4a14e1ef7ebe3fcf" + }, + { + "path": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl", + "byteLength": 406, + "sha256": "4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b" + }, + { + "path": "kernels/4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1.wgsl", + "byteLength": 500, + "sha256": "4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1" + }, + { + "path": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl", + "byteLength": 305, + "sha256": "4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74" + }, + { + "path": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl", + "byteLength": 330, + "sha256": "50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73" + }, + { + "path": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl", + "byteLength": 307, + "sha256": "51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759" + }, + { + "path": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl", + "byteLength": 402, + "sha256": "52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57" + }, + { + "path": "kernels/5244c41c17f08956963dde4c3784e8e122ba0e3c0d76794c8b3673252f672f27.wgsl", + "byteLength": 1388, + "sha256": "5244c41c17f08956963dde4c3784e8e122ba0e3c0d76794c8b3673252f672f27" + }, + { + "path": "kernels/52b439507af68e969a6e116d3c8ea5338a4cde5a3fc1e97b729512d17ab2f4f9.wgsl", + "byteLength": 305, + "sha256": "52b439507af68e969a6e116d3c8ea5338a4cde5a3fc1e97b729512d17ab2f4f9" + }, + { + "path": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl", + "byteLength": 1384, + "sha256": "52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292" + }, + { + "path": "kernels/53d6eb0b5e6d49bfd3bb9fd1b781e13317adf528e047da2416e95f5a3a13b1b4.wgsl", + "byteLength": 381, + "sha256": "53d6eb0b5e6d49bfd3bb9fd1b781e13317adf528e047da2416e95f5a3a13b1b4" + }, + { + "path": "kernels/55b9c48ba429daf80bbae0b4737f895b475abdc9ddfdc88ab2f894f133ec2bf9.wgsl", + "byteLength": 326, + "sha256": "55b9c48ba429daf80bbae0b4737f895b475abdc9ddfdc88ab2f894f133ec2bf9" + }, + { + "path": "kernels/56167a7e8fb1c67fa72948a8baa71866d54cc775be83f8cfa75a947ac0f58b12.wgsl", + "byteLength": 288, + "sha256": "56167a7e8fb1c67fa72948a8baa71866d54cc775be83f8cfa75a947ac0f58b12" + }, + { + "path": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl", + "byteLength": 847, + "sha256": "564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd" + }, + { + "path": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl", + "byteLength": 604, + "sha256": "56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0" + }, + { + "path": "kernels/577120bb3cdd5d1fb64df75a3d9d9bfb7df9a47cbe10c3df4702cdedda8742f2.wgsl", + "byteLength": 665, + "sha256": "577120bb3cdd5d1fb64df75a3d9d9bfb7df9a47cbe10c3df4702cdedda8742f2" + }, + { + "path": "kernels/57dc406322bf3badd8490493ef924bd7e7e0afd542d2d6e409b4d8a3b4b784f7.wgsl", + "byteLength": 286, + "sha256": "57dc406322bf3badd8490493ef924bd7e7e0afd542d2d6e409b4d8a3b4b784f7" + }, + { + "path": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl", + "byteLength": 405, + "sha256": "58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3" + }, + { + "path": "kernels/58a04f81024c554fa7384cf7989536e51ab65a353203039f95c9787453ee627c.wgsl", + "byteLength": 1388, + "sha256": "58a04f81024c554fa7384cf7989536e51ab65a353203039f95c9787453ee627c" + }, + { + "path": "kernels/59ea88d691b919af03bbb26f0253decfbc35d74f9661cdd3a08570ae85c313d2.wgsl", + "byteLength": 379, + "sha256": "59ea88d691b919af03bbb26f0253decfbc35d74f9661cdd3a08570ae85c313d2" + }, + { + "path": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl", + "byteLength": 849, + "sha256": "5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044" + }, + { + "path": "kernels/5b490e5074446b3ca05ffdd5f79c18e32aa5c23339dd93c75956125f4caba51f.wgsl", + "byteLength": 851, + "sha256": "5b490e5074446b3ca05ffdd5f79c18e32aa5c23339dd93c75956125f4caba51f" + }, + { + "path": "kernels/5b657fa4e308a89ca0d0edb8cb2a485d6f048dcdbcffb9e2c3a50073be7ad3ff.wgsl", + "byteLength": 1475, + "sha256": "5b657fa4e308a89ca0d0edb8cb2a485d6f048dcdbcffb9e2c3a50073be7ad3ff" + }, + { + "path": "kernels/5c22e6f60217881c0351e38d19057626a6c2292771c1a83816995245777ac2fd.wgsl", + "byteLength": 397, + "sha256": "5c22e6f60217881c0351e38d19057626a6c2292771c1a83816995245777ac2fd" + }, + { + "path": "kernels/5c9a5ae6121b3b10611e09e5f1bc563b70191f2506a2afc0f32de823a9d2dac4.wgsl", + "byteLength": 554, + "sha256": "5c9a5ae6121b3b10611e09e5f1bc563b70191f2506a2afc0f32de823a9d2dac4" + }, + { + "path": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl", + "byteLength": 556, + "sha256": "5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51" + }, + { + "path": "kernels/5eac5f92aa4d18895369b11adb99ac0d9639d8b615f7240cffe6f6be7046e54a.wgsl", + "byteLength": 845, + "sha256": "5eac5f92aa4d18895369b11adb99ac0d9639d8b615f7240cffe6f6be7046e54a" + }, + { + "path": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl", + "byteLength": 290, + "sha256": "5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a" + }, + { + "path": "kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl", + "byteLength": 373, + "sha256": "5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357" + }, + { + "path": "kernels/5f657afde3ab80a1fc4b6739c0b702bc5bd60e52630762e66b210fbb8b42b52a.wgsl", + "byteLength": 403, + "sha256": "5f657afde3ab80a1fc4b6739c0b702bc5bd60e52630762e66b210fbb8b42b52a" + }, + { + "path": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl", + "byteLength": 391, + "sha256": "5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf" + }, + { + "path": "kernels/5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec.wgsl", + "byteLength": 373, + "sha256": "5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec" + }, + { + "path": "kernels/5fd6e068841f5c054392bef564909dbf086bae9e4030f3625d1143244a08cbbf.wgsl", + "byteLength": 495, + "sha256": "5fd6e068841f5c054392bef564909dbf086bae9e4030f3625d1143244a08cbbf" + }, + { + "path": "kernels/5ffab5e011b6e44aae54b4287fcbe68c4a20cee0779818a3178470f3b6d5ffd6.wgsl", + "byteLength": 663, + "sha256": "5ffab5e011b6e44aae54b4287fcbe68c4a20cee0779818a3178470f3b6d5ffd6" + }, + { + "path": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl", + "byteLength": 373, + "sha256": "605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f" + }, + { + "path": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl", + "byteLength": 598, + "sha256": "60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5" + }, + { + "path": "kernels/62708aacbfcd0063a897e3348ae69a00d4dd155fce6665b18c5176224b039e12.wgsl", + "byteLength": 664, + "sha256": "62708aacbfcd0063a897e3348ae69a00d4dd155fce6665b18c5176224b039e12" + }, + { + "path": "kernels/62f30a62c18ed78c9bf37bdc56529accbee2264b9eac931ba0b35a80bb917e7c.wgsl", + "byteLength": 372, + "sha256": "62f30a62c18ed78c9bf37bdc56529accbee2264b9eac931ba0b35a80bb917e7c" + }, + { + "path": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl", + "byteLength": 401, + "sha256": "63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6" + }, + { + "path": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl", + "byteLength": 319, + "sha256": "64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1" + }, + { + "path": "kernels/6633b8c4bd21f4e281eb976cdf9e94037ea3de39224dc79ad89e46b6569f5a60.wgsl", + "byteLength": 1517, + "sha256": "6633b8c4bd21f4e281eb976cdf9e94037ea3de39224dc79ad89e46b6569f5a60" + }, + { + "path": "kernels/66978c862f8d1e391ded2424a4132cfea5f0cc7686c76610502bb596224db368.wgsl", + "byteLength": 1161, + "sha256": "66978c862f8d1e391ded2424a4132cfea5f0cc7686c76610502bb596224db368" + }, + { + "path": "kernels/66d2c54f014fcbb9053b0710f63280a933d6ad881f5af3c6df4b553c56b53a53.wgsl", + "byteLength": 1519, + "sha256": "66d2c54f014fcbb9053b0710f63280a933d6ad881f5af3c6df4b553c56b53a53" + }, + { + "path": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl", + "byteLength": 395, + "sha256": "67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139" + }, + { + "path": "kernels/67978e951813ede8016ebf553fb8d3b4ce9e15dd184810544879559208d6b7e1.wgsl", + "byteLength": 322, + "sha256": "67978e951813ede8016ebf553fb8d3b4ce9e15dd184810544879559208d6b7e1" + }, + { + "path": "kernels/687a9faf59b35be173c2861749834333b53400d1dd22bf430cef04722237a309.wgsl", + "byteLength": 661, + "sha256": "687a9faf59b35be173c2861749834333b53400d1dd22bf430cef04722237a309" + }, + { + "path": "kernels/690d8dfb579e55be9c90fa8375f6e2ddde55256a6552a59d83e054f34b485ea0.wgsl", + "byteLength": 1475, + "sha256": "690d8dfb579e55be9c90fa8375f6e2ddde55256a6552a59d83e054f34b485ea0" + }, + { + "path": "kernels/691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91.wgsl", + "byteLength": 503, + "sha256": "691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91" + }, + { + "path": "kernels/695f529f0e562834854d654e481bdf53c35ad4428f76f66595b3c57cbad54423.wgsl", + "byteLength": 595, + "sha256": "695f529f0e562834854d654e481bdf53c35ad4428f76f66595b3c57cbad54423" + }, + { + "path": "kernels/6a045508377e47e95d411257071b7ed8f9097fd220c00de6a5167abb548ebe37.wgsl", + "byteLength": 750, + "sha256": "6a045508377e47e95d411257071b7ed8f9097fd220c00de6a5167abb548ebe37" + }, + { + "path": "kernels/6a7b2e3778a02c76155d46fa84aeb33f594954e82e09b6b7f2915c0a606eb3f5.wgsl", + "byteLength": 471, + "sha256": "6a7b2e3778a02c76155d46fa84aeb33f594954e82e09b6b7f2915c0a606eb3f5" + }, + { + "path": "kernels/6ad3e0f21f70c7cb284d8f0115a3e89349d86bb63af4eae8aa70d6c3b1ae1131.wgsl", + "byteLength": 1163, + "sha256": "6ad3e0f21f70c7cb284d8f0115a3e89349d86bb63af4eae8aa70d6c3b1ae1131" + }, + { + "path": "kernels/6ae4c7f13978e60e3f4ccd5b8172af88d7dc24cfdb236e51b826f13a03d8cd02.wgsl", + "byteLength": 400, + "sha256": "6ae4c7f13978e60e3f4ccd5b8172af88d7dc24cfdb236e51b826f13a03d8cd02" + }, + { + "path": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl", + "byteLength": 396, + "sha256": "6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc" + }, + { + "path": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl", + "byteLength": 407, + "sha256": "6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09" + }, + { + "path": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl", + "byteLength": 607, + "sha256": "6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db" + }, + { + "path": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl", + "byteLength": 407, + "sha256": "6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d" + }, + { + "path": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl", + "byteLength": 417, + "sha256": "6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9" + }, + { + "path": "kernels/6e158cae64ceafa60c5498129bbc4482684844432772c61a9f2cfb62482bdeb4.wgsl", + "byteLength": 660, + "sha256": "6e158cae64ceafa60c5498129bbc4482684844432772c61a9f2cfb62482bdeb4" + }, + { + "path": "kernels/7002f8fdf09f5124ce2875c3540bce3e77750260556fc1a00a8b13b6c1871c30.wgsl", + "byteLength": 383, + "sha256": "7002f8fdf09f5124ce2875c3540bce3e77750260556fc1a00a8b13b6c1871c30" + }, + { + "path": "kernels/70dd45c48a989e6617431d39bc63f0187859f791c0915bcfc95fd6ebf4153403.wgsl", + "byteLength": 1514, + "sha256": "70dd45c48a989e6617431d39bc63f0187859f791c0915bcfc95fd6ebf4153403" + }, + { + "path": "kernels/7121b5c223da0b0f28991f55cfed3c3f3390caa0bf65a8e58ae380db281ceb6b.wgsl", + "byteLength": 368, + "sha256": "7121b5c223da0b0f28991f55cfed3c3f3390caa0bf65a8e58ae380db281ceb6b" + }, + { + "path": "kernels/7183997261247fa4df7e081c0d6d01036fee95b9b57ef944d5f44f72fc80d5fe.wgsl", + "byteLength": 285, + "sha256": "7183997261247fa4df7e081c0d6d01036fee95b9b57ef944d5f44f72fc80d5fe" + }, + { + "path": "kernels/71d38690bcc7fc30f01f1c8fa2f13a38beff889fcb3ff387861bb70038e92129.wgsl", + "byteLength": 370, + "sha256": "71d38690bcc7fc30f01f1c8fa2f13a38beff889fcb3ff387861bb70038e92129" + }, + { + "path": "kernels/720dc88131b6bf06e6b09185aa7d5986eb755dcfa60d0e040cbbf621c8f3f761.wgsl", + "byteLength": 559, + "sha256": "720dc88131b6bf06e6b09185aa7d5986eb755dcfa60d0e040cbbf621c8f3f761" + }, + { + "path": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl", + "byteLength": 406, + "sha256": "72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc" + }, + { + "path": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl", + "byteLength": 309, + "sha256": "73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95" + }, + { + "path": "kernels/742db031d819fdf5a756f37e8e824e2dcb2ca3f30efac3ffbd5918181059ae3a.wgsl", + "byteLength": 393, + "sha256": "742db031d819fdf5a756f37e8e824e2dcb2ca3f30efac3ffbd5918181059ae3a" + }, + { + "path": "kernels/752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3.wgsl", + "byteLength": 369, + "sha256": "752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3" + }, + { + "path": "kernels/764403c33cd8994568e068810380cb57e9f2e326dfc09bed63eed1fbed044da1.wgsl", + "byteLength": 311, + "sha256": "764403c33cd8994568e068810380cb57e9f2e326dfc09bed63eed1fbed044da1" + }, + { + "path": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl", + "byteLength": 389, + "sha256": "77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa" + }, + { + "path": "kernels/7928d1b13d79c16f6c0f9d3130cbdb4193cab6efe3a60b38caa1039688fe56de.wgsl", + "byteLength": 286, + "sha256": "7928d1b13d79c16f6c0f9d3130cbdb4193cab6efe3a60b38caa1039688fe56de" + }, + { + "path": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl", + "byteLength": 417, + "sha256": "793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34" + }, + { + "path": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl", + "byteLength": 393, + "sha256": "793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01" + }, + { + "path": "kernels/79ab685c48a01097e551291e8bb7ea554f69b07f6fd1494aaa829ddcb0eeb8d1.wgsl", + "byteLength": 665, + "sha256": "79ab685c48a01097e551291e8bb7ea554f69b07f6fd1494aaa829ddcb0eeb8d1" + }, + { + "path": "kernels/7adea2b745b20a2abb96d02a1fca6db5f06f3c5aac850cf8ae1afa6f50868ded.wgsl", + "byteLength": 311, + "sha256": "7adea2b745b20a2abb96d02a1fca6db5f06f3c5aac850cf8ae1afa6f50868ded" + }, + { + "path": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl", + "byteLength": 406, + "sha256": "7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9" + }, + { + "path": "kernels/7ea4a12734f1206e9c94a060bf6b24732f46685f0c46a78c3c5fbcd64489d8c3.wgsl", + "byteLength": 407, + "sha256": "7ea4a12734f1206e9c94a060bf6b24732f46685f0c46a78c3c5fbcd64489d8c3" + }, + { + "path": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl", + "byteLength": 418, + "sha256": "7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da" + }, + { + "path": "kernels/7f7290e4615bdd5b73693e8c235e0a48e0e81ec5a1764fdebd1f04f29be3919a.wgsl", + "byteLength": 1515, + "sha256": "7f7290e4615bdd5b73693e8c235e0a48e0e81ec5a1764fdebd1f04f29be3919a" + }, + { + "path": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl", + "byteLength": 378, + "sha256": "7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187" + }, + { + "path": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl", + "byteLength": 290, + "sha256": "7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b" + }, + { + "path": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl", + "byteLength": 752, + "sha256": "7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0" + }, + { + "path": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl", + "byteLength": 404, + "sha256": "80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425" + }, + { + "path": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl", + "byteLength": 328, + "sha256": "816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8" + }, + { + "path": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl", + "byteLength": 406, + "sha256": "8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125" + }, + { + "path": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl", + "byteLength": 328, + "sha256": "827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5" + }, + { + "path": "kernels/82bc226410ee45662442e25040b6a6456c2532b87e96860e10f8f0135dde892b.wgsl", + "byteLength": 286, + "sha256": "82bc226410ee45662442e25040b6a6456c2532b87e96860e10f8f0135dde892b" + }, + { + "path": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl", + "byteLength": 556, + "sha256": "82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f" + }, + { + "path": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl", + "byteLength": 394, + "sha256": "84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138" + }, + { + "path": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl", + "byteLength": 608, + "sha256": "84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4" + }, + { + "path": "kernels/8485c3edc4d8013903fedc22091c7530a69a97da8b3dbd0cc5c55f54220709fb.wgsl", + "byteLength": 664, + "sha256": "8485c3edc4d8013903fedc22091c7530a69a97da8b3dbd0cc5c55f54220709fb" + }, + { + "path": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl", + "byteLength": 401, + "sha256": "84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b" + }, + { + "path": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl", + "byteLength": 381, + "sha256": "84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212" + }, + { + "path": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl", + "byteLength": 558, + "sha256": "85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680" + }, + { + "path": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl", + "byteLength": 415, + "sha256": "870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6" + }, + { + "path": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl", + "byteLength": 308, + "sha256": "87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46" + }, + { + "path": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl", + "byteLength": 292, + "sha256": "8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d" + }, + { + "path": "kernels/88b50ebddd13f3ff5e2819b8bc956e8fc1346e8f75cacbc3d0edf031b7f1f248.wgsl", + "byteLength": 306, + "sha256": "88b50ebddd13f3ff5e2819b8bc956e8fc1346e8f75cacbc3d0edf031b7f1f248" + }, + { + "path": "kernels/892b773325e143ad086ac3f3475f04c606f781b0ea3261a7168d28e3bdf24b49.wgsl", + "byteLength": 665, + "sha256": "892b773325e143ad086ac3f3475f04c606f781b0ea3261a7168d28e3bdf24b49" + }, + { + "path": "kernels/896006749045a93d89dca7ed7326aa05c5ff29423400569d34ab2256dea6b0e4.wgsl", + "byteLength": 383, + "sha256": "896006749045a93d89dca7ed7326aa05c5ff29423400569d34ab2256dea6b0e4" + }, + { + "path": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl", + "byteLength": 554, + "sha256": "898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09" + }, + { + "path": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl", + "byteLength": 409, + "sha256": "89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b" + }, + { + "path": "kernels/8a46c4e24d014fd6af88a3f370c4b6161be7c63b6c30211bd62af3dbd87293a8.wgsl", + "byteLength": 398, + "sha256": "8a46c4e24d014fd6af88a3f370c4b6161be7c63b6c30211bd62af3dbd87293a8" + }, + { + "path": "kernels/8acff95e1c324ceae0104784991a5262b08fc893c5b8bd3c7785579cc9958b0f.wgsl", + "byteLength": 1161, + "sha256": "8acff95e1c324ceae0104784991a5262b08fc893c5b8bd3c7785579cc9958b0f" + }, + { + "path": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl", + "byteLength": 408, + "sha256": "8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c" + }, + { + "path": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl", + "byteLength": 565, + "sha256": "8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46" + }, + { + "path": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl", + "byteLength": 405, + "sha256": "8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d" + }, + { + "path": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl", + "byteLength": 387, + "sha256": "8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f" + }, + { + "path": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl", + "byteLength": 399, + "sha256": "8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146" + }, + { + "path": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl", + "byteLength": 384, + "sha256": "8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21" + }, + { + "path": "kernels/8cce7bfa491959f6a7b62ae9cb861d12e2f4ff05227918a4d06bd80669f0a539.wgsl", + "byteLength": 372, + "sha256": "8cce7bfa491959f6a7b62ae9cb861d12e2f4ff05227918a4d06bd80669f0a539" + }, + { + "path": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl", + "byteLength": 303, + "sha256": "8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab" + }, + { + "path": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl", + "byteLength": 324, + "sha256": "8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab" + }, + { + "path": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl", + "byteLength": 603, + "sha256": "8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16" + }, + { + "path": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl", + "byteLength": 414, + "sha256": "8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58" + }, + { + "path": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl", + "byteLength": 464, + "sha256": "8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c" + }, + { + "path": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl", + "byteLength": 431, + "sha256": "8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c" + }, + { + "path": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl", + "byteLength": 853, + "sha256": "8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235" + }, + { + "path": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl", + "byteLength": 292, + "sha256": "8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3" + }, + { + "path": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl", + "byteLength": 403, + "sha256": "8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8" + }, + { + "path": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl", + "byteLength": 1408, + "sha256": "8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d" + }, + { + "path": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl", + "byteLength": 419, + "sha256": "9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a" + }, + { + "path": "kernels/9144d827dae4c52b80abb829178a9ed901ce5dbc6702ad94b0b355e8eaad5ea5.wgsl", + "byteLength": 548, + "sha256": "9144d827dae4c52b80abb829178a9ed901ce5dbc6702ad94b0b355e8eaad5ea5" + }, + { + "path": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl", + "byteLength": 563, + "sha256": "928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858" + }, + { + "path": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl", + "byteLength": 606, + "sha256": "939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c" + }, + { + "path": "kernels/93e55da461fee2fdd3074c679d22ef530e0767cfe37f076dd6a2d538d76576e7.wgsl", + "byteLength": 1161, + "sha256": "93e55da461fee2fdd3074c679d22ef530e0767cfe37f076dd6a2d538d76576e7" + }, + { + "path": "kernels/947f5cc8b3f87e1a0d4d322d9d9e71e2ed16ce6e1f7c91118678c164dc1c8752.wgsl", + "byteLength": 381, + "sha256": "947f5cc8b3f87e1a0d4d322d9d9e71e2ed16ce6e1f7c91118678c164dc1c8752" + }, + { + "path": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl", + "byteLength": 288, + "sha256": "94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775" + }, + { + "path": "kernels/95addfdb139df33bb3d5c05859412434d318cee0340560537dce4d56a05e159c.wgsl", + "byteLength": 395, + "sha256": "95addfdb139df33bb3d5c05859412434d318cee0340560537dce4d56a05e159c" + }, + { + "path": "kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl", + "byteLength": 372, + "sha256": "95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b" + }, + { + "path": "kernels/9625ca0b071511e5261877fd21627ca354ea0219da86a10887e8054afa15dcfd.wgsl", + "byteLength": 367, + "sha256": "9625ca0b071511e5261877fd21627ca354ea0219da86a10887e8054afa15dcfd" + }, + { + "path": "kernels/965eda70c95973cd351f2a5097ee9100166c74b6533c36c9eec9873b228cbd30.wgsl", + "byteLength": 1518, + "sha256": "965eda70c95973cd351f2a5097ee9100166c74b6533c36c9eec9873b228cbd30" + }, + { + "path": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl", + "byteLength": 421, + "sha256": "9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f" + }, + { + "path": "kernels/970aa8fd65c7e96611a4b6f30cb0b71e24bdaefff0ca117243cab1a5a7e645a9.wgsl", + "byteLength": 286, + "sha256": "970aa8fd65c7e96611a4b6f30cb0b71e24bdaefff0ca117243cab1a5a7e645a9" + }, + { + "path": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl", + "byteLength": 561, + "sha256": "97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d" + }, + { + "path": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl", + "byteLength": 1388, + "sha256": "97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510" + }, + { + "path": "kernels/985bb9ad33654b9adbd4a256d626e346556a10dad514692800da8ebd7910f0f0.wgsl", + "byteLength": 362, + "sha256": "985bb9ad33654b9adbd4a256d626e346556a10dad514692800da8ebd7910f0f0" + }, + { + "path": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl", + "byteLength": 380, + "sha256": "987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af" + }, + { + "path": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl", + "byteLength": 383, + "sha256": "99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b" + }, + { + "path": "kernels/9a9c990c9717c93933b1e7f5204d99a16276a177b7ca2f8c8cf61dbc1f6aaf51.wgsl", + "byteLength": 1384, + "sha256": "9a9c990c9717c93933b1e7f5204d99a16276a177b7ca2f8c8cf61dbc1f6aaf51" + }, + { + "path": "kernels/9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42.wgsl", + "byteLength": 301, + "sha256": "9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42" + }, + { + "path": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl", + "byteLength": 556, + "sha256": "9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074" + }, + { + "path": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl", + "byteLength": 383, + "sha256": "9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0" + }, + { + "path": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl", + "byteLength": 413, + "sha256": "9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773" + }, + { + "path": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl", + "byteLength": 328, + "sha256": "9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43" + }, + { + "path": "kernels/9f040facf0594804dba5b0f10f53b11b7223a1e1705896f95a8f95aa0fff5eec.wgsl", + "byteLength": 556, + "sha256": "9f040facf0594804dba5b0f10f53b11b7223a1e1705896f95a8f95aa0fff5eec" + }, + { + "path": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl", + "byteLength": 387, + "sha256": "a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6" + }, + { + "path": "kernels/a1a974f6d8d51fd7c3496ede0966af303ad9f0c0c9ee44cf93ec962d2b0e87e1.wgsl", + "byteLength": 303, + "sha256": "a1a974f6d8d51fd7c3496ede0966af303ad9f0c0c9ee44cf93ec962d2b0e87e1" + }, + { + "path": "kernels/a1cf6b03baf18d389f0a2b95440c17125a8ecc1e633568de985d42cac6e0d1cb.wgsl", + "byteLength": 373, + "sha256": "a1cf6b03baf18d389f0a2b95440c17125a8ecc1e633568de985d42cac6e0d1cb" + }, + { + "path": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl", + "byteLength": 373, + "sha256": "a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a" + }, + { + "path": "kernels/a21dc37cea5d4adc26465d78d5491b794129ded665b3b3c014438c11519a837c.wgsl", + "byteLength": 667, + "sha256": "a21dc37cea5d4adc26465d78d5491b794129ded665b3b3c014438c11519a837c" + }, + { + "path": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl", + "byteLength": 390, + "sha256": "a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7" + }, + { + "path": "kernels/a26ccdf9414d63e640b21dbfb8191252a532ad248ad8a975bf64438d6c861edb.wgsl", + "byteLength": 654, + "sha256": "a26ccdf9414d63e640b21dbfb8191252a532ad248ad8a975bf64438d6c861edb" + }, + { + "path": "kernels/a2bd65fc2709e093644d6cbf0c292b4d71520009a87bedcf4bca8fcb5f5c15b8.wgsl", + "byteLength": 286, + "sha256": "a2bd65fc2709e093644d6cbf0c292b4d71520009a87bedcf4bca8fcb5f5c15b8" + }, + { + "path": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl", + "byteLength": 326, + "sha256": "a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007" + }, + { + "path": "kernels/a37dac611b27158f19aa5bd70c43217286e610e733cbd602b91666b4af42d3ef.wgsl", + "byteLength": 285, + "sha256": "a37dac611b27158f19aa5bd70c43217286e610e733cbd602b91666b4af42d3ef" + }, + { + "path": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl", + "byteLength": 326, + "sha256": "a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92" + }, + { + "path": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl", + "byteLength": 2305, + "sha256": "a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856" + }, + { + "path": "kernels/a672c3e158716bde7444c8141f3df1da16da739ccdd2eb2ad60f9d42d0775157.wgsl", + "byteLength": 505, + "sha256": "a672c3e158716bde7444c8141f3df1da16da739ccdd2eb2ad60f9d42d0775157" + }, + { + "path": "kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl", + "byteLength": 307, + "sha256": "a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b" + }, + { + "path": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl", + "byteLength": 373, + "sha256": "a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f" + }, + { + "path": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl", + "byteLength": 377, + "sha256": "a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db" + }, + { + "path": "kernels/a87152b0fd2f78f60d7abb61c2f6c4a9bde8a9dd45d0275b58d760a3da9f71ce.wgsl", + "byteLength": 575, + "sha256": "a87152b0fd2f78f60d7abb61c2f6c4a9bde8a9dd45d0275b58d760a3da9f71ce" + }, + { + "path": "kernels/a896c93b04922c0f78f1c77fbaabbc79eb71776223748bb32a6d5339e32029e8.wgsl", + "byteLength": 308, + "sha256": "a896c93b04922c0f78f1c77fbaabbc79eb71776223748bb32a6d5339e32029e8" + }, + { + "path": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl", + "byteLength": 386, + "sha256": "a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986" + }, + { + "path": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl", + "byteLength": 369, + "sha256": "a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b" + }, + { + "path": "kernels/a9fa5db20fa8de1de429c6850c3e40ff8180bcdb59373919b84d2438b3b17352.wgsl", + "byteLength": 368, + "sha256": "a9fa5db20fa8de1de429c6850c3e40ff8180bcdb59373919b84d2438b3b17352" + }, + { + "path": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl", + "byteLength": 367, + "sha256": "aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382" + }, + { + "path": "kernels/aa59c60790adcd3ed6930671d42ad5f38c4947fcaa607270ddc2e337c19ddc46.wgsl", + "byteLength": 1153, + "sha256": "aa59c60790adcd3ed6930671d42ad5f38c4947fcaa607270ddc2e337c19ddc46" + }, + { + "path": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl", + "byteLength": 292, + "sha256": "aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510" + }, + { + "path": "kernels/abdb17daf29310a7828a55a1efeebaa65b6553e236fc20702e8c712e0a46dd5b.wgsl", + "byteLength": 326, + "sha256": "abdb17daf29310a7828a55a1efeebaa65b6553e236fc20702e8c712e0a46dd5b" + }, + { + "path": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl", + "byteLength": 391, + "sha256": "ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c" + }, + { + "path": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl", + "byteLength": 601, + "sha256": "ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a" + }, + { + "path": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl", + "byteLength": 402, + "sha256": "ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57" + }, + { + "path": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl", + "byteLength": 307, + "sha256": "adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c" + }, + { + "path": "kernels/ae69e698c92571766e36ad8c078b13e42bde56745d45698daaadaca587b7279c.wgsl", + "byteLength": 551, + "sha256": "ae69e698c92571766e36ad8c078b13e42bde56745d45698daaadaca587b7279c" + }, + { + "path": "kernels/aeee4bc86f9b4986043125d462e8fed051591da36bd013e5c7c31c3449353452.wgsl", + "byteLength": 663, + "sha256": "aeee4bc86f9b4986043125d462e8fed051591da36bd013e5c7c31c3449353452" + }, + { + "path": "kernels/b02b0be460d581c720afd68c8b722e8da47e2ee432b5d61bbdf24b6084cb2f26.wgsl", + "byteLength": 415, + "sha256": "b02b0be460d581c720afd68c8b722e8da47e2ee432b5d61bbdf24b6084cb2f26" + }, + { + "path": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl", + "byteLength": 390, + "sha256": "b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33" + }, + { + "path": "kernels/b1741cc45db17fa6e66bd797a89a3e3ca7cc70854e55c9e549d4f8500ef5a509.wgsl", + "byteLength": 665, + "sha256": "b1741cc45db17fa6e66bd797a89a3e3ca7cc70854e55c9e549d4f8500ef5a509" + }, + { + "path": "kernels/b199d835db70f888c7b99a3ac6e9ec56f6c47d5bba4eaf352e0a8eabed56411e.wgsl", + "byteLength": 387, + "sha256": "b199d835db70f888c7b99a3ac6e9ec56f6c47d5bba4eaf352e0a8eabed56411e" + }, + { + "path": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl", + "byteLength": 290, + "sha256": "b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839" + }, + { + "path": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl", + "byteLength": 400, + "sha256": "b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2" + }, + { + "path": "kernels/b2b16798cbe94c919025d76b0435afe47966ffdd1ea53ec74a791c03c4709a28.wgsl", + "byteLength": 380, + "sha256": "b2b16798cbe94c919025d76b0435afe47966ffdd1ea53ec74a791c03c4709a28" + }, + { + "path": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl", + "byteLength": 418, + "sha256": "b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7" + }, + { + "path": "kernels/b3bb2905555188f535b6b8bc1d050c142b5fea8222d9ef193466f80aa2c54dea.wgsl", + "byteLength": 556, + "sha256": "b3bb2905555188f535b6b8bc1d050c142b5fea8222d9ef193466f80aa2c54dea" + }, + { + "path": "kernels/b3c44f5f11a5fcc5c32ce6a1167f2b1232839113872306dcd7023ad9fe385c29.wgsl", + "byteLength": 288, + "sha256": "b3c44f5f11a5fcc5c32ce6a1167f2b1232839113872306dcd7023ad9fe385c29" + }, + { + "path": "kernels/b57928140994202536cd4f99d2e14f5dba9754f014843673790d5d48c9cbb9ab.wgsl", + "byteLength": 390, + "sha256": "b57928140994202536cd4f99d2e14f5dba9754f014843673790d5d48c9cbb9ab" + }, + { + "path": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl", + "byteLength": 405, + "sha256": "b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857" + }, + { + "path": "kernels/b64a63c60f91d717d7879df834c3443b1675c875093fad7b05da47fac5d61fc4.wgsl", + "byteLength": 413, + "sha256": "b64a63c60f91d717d7879df834c3443b1675c875093fad7b05da47fac5d61fc4" + }, + { + "path": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl", + "byteLength": 326, + "sha256": "b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49" + }, + { + "path": "kernels/ba2fd5d2796d03870e6787ea917515484f75affcf1c686e659be259525b60f72.wgsl", + "byteLength": 1518, + "sha256": "ba2fd5d2796d03870e6787ea917515484f75affcf1c686e659be259525b60f72" + }, + { + "path": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl", + "byteLength": 421, + "sha256": "bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6" + }, + { + "path": "kernels/bb9029b667eeb13670d1f640cd677c6eabd7a7569686c599e3eeb9482d642b00.wgsl", + "byteLength": 373, + "sha256": "bb9029b667eeb13670d1f640cd677c6eabd7a7569686c599e3eeb9482d642b00" + }, + { + "path": "kernels/bbd5391ed53f61346ee046aaa2fefdc65ea0ffde1ca891b51e4586b745f453c0.wgsl", + "byteLength": 1517, + "sha256": "bbd5391ed53f61346ee046aaa2fefdc65ea0ffde1ca891b51e4586b745f453c0" + }, + { + "path": "kernels/bc22275618821f75af681d7a4d901fcd863aefc1ab3cf44da85ef9b0cf8b6790.wgsl", + "byteLength": 665, + "sha256": "bc22275618821f75af681d7a4d901fcd863aefc1ab3cf44da85ef9b0cf8b6790" + }, + { + "path": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl", + "byteLength": 851, + "sha256": "bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566" + }, + { + "path": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl", + "byteLength": 401, + "sha256": "bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469" + }, + { + "path": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl", + "byteLength": 416, + "sha256": "bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658" + }, + { + "path": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl", + "byteLength": 383, + "sha256": "bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759" + }, + { + "path": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl", + "byteLength": 556, + "sha256": "bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60" + }, + { + "path": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl", + "byteLength": 383, + "sha256": "c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258" + }, + { + "path": "kernels/c0a7f99d0ce8f9a199b9baa52effe47afa9605f77405c32b32d132be1f7404f1.wgsl", + "byteLength": 286, + "sha256": "c0a7f99d0ce8f9a199b9baa52effe47afa9605f77405c32b32d132be1f7404f1" + }, + { + "path": "kernels/c0b2947798baa198598d75ca0e5dcd31a9fa320499665e34f7bb81d27fc15fb0.wgsl", + "byteLength": 307, + "sha256": "c0b2947798baa198598d75ca0e5dcd31a9fa320499665e34f7bb81d27fc15fb0" + }, + { + "path": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl", + "byteLength": 459, + "sha256": "c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33" + }, + { + "path": "kernels/c23bee3c3664172bf0a078a96acd2b3ad3136732234975f757d313e696c2c37a.wgsl", + "byteLength": 381, + "sha256": "c23bee3c3664172bf0a078a96acd2b3ad3136732234975f757d313e696c2c37a" + }, + { + "path": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl", + "byteLength": 387, + "sha256": "c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3" + }, + { + "path": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl", + "byteLength": 382, + "sha256": "c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007" + }, + { + "path": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl", + "byteLength": 1410, + "sha256": "c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117" + }, + { + "path": "kernels/c2c806bbe93f09247867b4ace45489a5f2fe3ee67f265418eb7aa71a29880276.wgsl", + "byteLength": 315, + "sha256": "c2c806bbe93f09247867b4ace45489a5f2fe3ee67f265418eb7aa71a29880276" + }, + { + "path": "kernels/c2e7cdc03edb25ef7a160965c17c559b6ec7e139c145dc7390b73523bacba5bb.wgsl", + "byteLength": 288, + "sha256": "c2e7cdc03edb25ef7a160965c17c559b6ec7e139c145dc7390b73523bacba5bb" + }, + { + "path": "kernels/c34050971c037d57e84cc2cb44cf16ab73314cd30068d733c5ca430df1eea52d.wgsl", + "byteLength": 663, + "sha256": "c34050971c037d57e84cc2cb44cf16ab73314cd30068d733c5ca430df1eea52d" + }, + { + "path": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl", + "byteLength": 385, + "sha256": "c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e" + }, + { + "path": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl", + "byteLength": 414, + "sha256": "c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae" + }, + { + "path": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl", + "byteLength": 851, + "sha256": "c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4" + }, + { + "path": "kernels/c3bd80f93b1c138960984d55cff71cd88a93016723f80d30b3340ddb503620c4.wgsl", + "byteLength": 1521, + "sha256": "c3bd80f93b1c138960984d55cff71cd88a93016723f80d30b3340ddb503620c4" + }, + { + "path": "kernels/c4862be63d2532b6891da039edbef2f46737a34518f8a89602821e00447b5933.wgsl", + "byteLength": 385, + "sha256": "c4862be63d2532b6891da039edbef2f46737a34518f8a89602821e00447b5933" + }, + { + "path": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl", + "byteLength": 286, + "sha256": "c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9" + }, + { + "path": "kernels/c804a18a7bed0d1c647838cab84658e1a40005fc2100decef96e2ed66e1f8c0b.wgsl", + "byteLength": 415, + "sha256": "c804a18a7bed0d1c647838cab84658e1a40005fc2100decef96e2ed66e1f8c0b" + }, + { + "path": "kernels/c82539b0cdc61c953c4b7feb51ddc9a52206bd51b37bd1a22e45830e5e6162d7.wgsl", + "byteLength": 1523, + "sha256": "c82539b0cdc61c953c4b7feb51ddc9a52206bd51b37bd1a22e45830e5e6162d7" + }, + { + "path": "kernels/c83a2a6faf563ec3bbad43a3e108d58c09cd8aeed01b38e4e82d1c3c9b650c21.wgsl", + "byteLength": 378, + "sha256": "c83a2a6faf563ec3bbad43a3e108d58c09cd8aeed01b38e4e82d1c3c9b650c21" + }, + { + "path": "kernels/c8c077eea97ee78f1f10dacccd47d60cd76278ea99d0863ce3ca8f16601785bd.wgsl", + "byteLength": 411, + "sha256": "c8c077eea97ee78f1f10dacccd47d60cd76278ea99d0863ce3ca8f16601785bd" + }, + { + "path": "kernels/c90428425f6d220b441e97e3b894adfb090869c98b17f53afbd2f9fb202b4525.wgsl", + "byteLength": 307, + "sha256": "c90428425f6d220b441e97e3b894adfb090869c98b17f53afbd2f9fb202b4525" + }, + { + "path": "kernels/c9d90936ab6b78afdcd34c23c05b9b3cd93c021ccf9ac1645714b6a919f6dfbd.wgsl", + "byteLength": 663, + "sha256": "c9d90936ab6b78afdcd34c23c05b9b3cd93c021ccf9ac1645714b6a919f6dfbd" + }, + { + "path": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl", + "byteLength": 377, + "sha256": "c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a" + }, + { + "path": "kernels/ca9a3115f8f3881eee99e421cb4f259113b13bb4c107348279bb92c643a52197.wgsl", + "byteLength": 311, + "sha256": "ca9a3115f8f3881eee99e421cb4f259113b13bb4c107348279bb92c643a52197" + }, + { + "path": "kernels/cc250879ffbf43ba05860b5a86f6a824e8ca7b4c9f820137a68e1ba633e09738.wgsl", + "byteLength": 573, + "sha256": "cc250879ffbf43ba05860b5a86f6a824e8ca7b4c9f820137a68e1ba633e09738" + }, + { + "path": "kernels/ccb303d2d38ef10c1cf514f01ec2fa3b2541734aca8a34b3e8bb8d71d03a6688.wgsl", + "byteLength": 603, + "sha256": "ccb303d2d38ef10c1cf514f01ec2fa3b2541734aca8a34b3e8bb8d71d03a6688" + }, + { + "path": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl", + "byteLength": 419, + "sha256": "cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37" + }, + { + "path": "kernels/cdc784b39918d10424edc08d2e44da0075863e8fd41ae362f5695a248363531d.wgsl", + "byteLength": 1406, + "sha256": "cdc784b39918d10424edc08d2e44da0075863e8fd41ae362f5695a248363531d" + }, + { + "path": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl", + "byteLength": 408, + "sha256": "d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9" + }, + { + "path": "kernels/d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957.wgsl", + "byteLength": 390, + "sha256": "d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957" + }, + { + "path": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl", + "byteLength": 375, + "sha256": "d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96" + }, + { + "path": "kernels/d418d3ee7df4b3d5c78742deeebd6338ae749b09cf5eadb52cc4e68bbd9ce3fa.wgsl", + "byteLength": 663, + "sha256": "d418d3ee7df4b3d5c78742deeebd6338ae749b09cf5eadb52cc4e68bbd9ce3fa" + }, + { + "path": "kernels/d44354e74d5bfca2fb879607683c5d04cb30c4e1a694270584a01c0c6b3d9be8.wgsl", + "byteLength": 288, + "sha256": "d44354e74d5bfca2fb879607683c5d04cb30c4e1a694270584a01c0c6b3d9be8" + }, + { + "path": "kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl", + "byteLength": 378, + "sha256": "d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e" + }, + { + "path": "kernels/d8c79a22e83e4a3b75b732bffa9ca673713bb57d580c5af4e59c805645ff1ca3.wgsl", + "byteLength": 309, + "sha256": "d8c79a22e83e4a3b75b732bffa9ca673713bb57d580c5af4e59c805645ff1ca3" + }, + { + "path": "kernels/da7c63a84d7f2c46e8234a34c0905cfad6229740145070df00819509f8ab39de.wgsl", + "byteLength": 288, + "sha256": "da7c63a84d7f2c46e8234a34c0905cfad6229740145070df00819509f8ab39de" + }, + { + "path": "kernels/dc4ee648b97b273931e31c95b910d66f11e34a1cb036589e9ae9cc250b6e6291.wgsl", + "byteLength": 286, + "sha256": "dc4ee648b97b273931e31c95b910d66f11e34a1cb036589e9ae9cc250b6e6291" + }, + { + "path": "kernels/dd544e5a005b68617e9a3557e1d24dd6282a5a62f47cae4cc41b619d3a1cd603.wgsl", + "byteLength": 582, + "sha256": "dd544e5a005b68617e9a3557e1d24dd6282a5a62f47cae4cc41b619d3a1cd603" + }, + { + "path": "kernels/de276eae1430ed164ae977ce4b005301ea0f2652bed1f879acb3a355e600ff5e.wgsl", + "byteLength": 365, + "sha256": "de276eae1430ed164ae977ce4b005301ea0f2652bed1f879acb3a355e600ff5e" + }, + { + "path": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl", + "byteLength": 315, + "sha256": "de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9" + }, + { + "path": "kernels/deb451a300a279d0325fe3be090515d4daae6b3232d87b8e2c050991388ac00f.wgsl", + "byteLength": 373, + "sha256": "deb451a300a279d0325fe3be090515d4daae6b3232d87b8e2c050991388ac00f" + }, + { + "path": "kernels/deee894ecb86334ff82870260fc5edbc36439c1d3bce09fab5708c03d699b390.wgsl", + "byteLength": 367, + "sha256": "deee894ecb86334ff82870260fc5edbc36439c1d3bce09fab5708c03d699b390" + }, + { + "path": "kernels/e01dc46d731ca9d3358814482da28b4edb8496243937be85ddde86a02a215169.wgsl", + "byteLength": 377, + "sha256": "e01dc46d731ca9d3358814482da28b4edb8496243937be85ddde86a02a215169" + }, + { + "path": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl", + "byteLength": 1410, + "sha256": "e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030" + }, + { + "path": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl", + "byteLength": 419, + "sha256": "e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7" + }, + { + "path": "kernels/e26328df0e65bd3b1aa31d12ed34e71b1b4b309d708bd58badcabad803bca34a.wgsl", + "byteLength": 415, + "sha256": "e26328df0e65bd3b1aa31d12ed34e71b1b4b309d708bd58badcabad803bca34a" + }, + { + "path": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl", + "byteLength": 610, + "sha256": "e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00" + }, + { + "path": "kernels/e38b21c1b50403e478d2d4956df390560aa740de2dcba8d69322d996c998adf4.wgsl", + "byteLength": 408, + "sha256": "e38b21c1b50403e478d2d4956df390560aa740de2dcba8d69322d996c998adf4" + }, + { + "path": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl", + "byteLength": 411, + "sha256": "e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d" + }, + { + "path": "kernels/e4a989431631a3036d713a383f15805979dcd1650f802ad1bbcee3ffc2d5aa54.wgsl", + "byteLength": 1157, + "sha256": "e4a989431631a3036d713a383f15805979dcd1650f802ad1bbcee3ffc2d5aa54" + }, + { + "path": "kernels/e6571e9ffa79d4f7888d606a5845a6fe7d39e3b7944eafb979c162a384245c66.wgsl", + "byteLength": 385, + "sha256": "e6571e9ffa79d4f7888d606a5845a6fe7d39e3b7944eafb979c162a384245c66" + }, + { + "path": "kernels/e6b78ab7b0b8ae70ff5c73287337f09473aede8d7740951a4d7518daf36c0601.wgsl", + "byteLength": 1521, + "sha256": "e6b78ab7b0b8ae70ff5c73287337f09473aede8d7740951a4d7518daf36c0601" + }, + { + "path": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl", + "byteLength": 383, + "sha256": "e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130" + }, + { + "path": "kernels/e829b3bd2efe5b094dc36238e2a933a1e30c942efddfc80e79862a55c57e6e20.wgsl", + "byteLength": 459, + "sha256": "e829b3bd2efe5b094dc36238e2a933a1e30c942efddfc80e79862a55c57e6e20" + }, + { + "path": "kernels/e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d.wgsl", + "byteLength": 299, + "sha256": "e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d" + }, + { + "path": "kernels/e867b978e7008207276fa1603c3c1c968a91d5b02e70daa63b1c9e462b6c36d2.wgsl", + "byteLength": 286, + "sha256": "e867b978e7008207276fa1603c3c1c968a91d5b02e70daa63b1c9e462b6c36d2" + }, + { + "path": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl", + "byteLength": 413, + "sha256": "e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d" + }, + { + "path": "kernels/eb062a9b5fdad085ac68638dd1218cd210d2aad87bd96e2adf505571076b881b.wgsl", + "byteLength": 661, + "sha256": "eb062a9b5fdad085ac68638dd1218cd210d2aad87bd96e2adf505571076b881b" + }, + { + "path": "kernels/eb52355cc0ef7f698f9c4a5667eb20a31652d69cdab4e0f0774b81464b9528ca.wgsl", + "byteLength": 652, + "sha256": "eb52355cc0ef7f698f9c4a5667eb20a31652d69cdab4e0f0774b81464b9528ca" + }, + { + "path": "kernels/eb77480d0d0529a45f6e0a1967f433c32b47ac7282ccc895f89d076949a71fbf.wgsl", + "byteLength": 663, + "sha256": "eb77480d0d0529a45f6e0a1967f433c32b47ac7282ccc895f89d076949a71fbf" + }, + { + "path": "kernels/ec606c53f8610fff07d8464d8f1cd2a909203cd4064d1be19ad9bdb42263794d.wgsl", + "byteLength": 596, + "sha256": "ec606c53f8610fff07d8464d8f1cd2a909203cd4064d1be19ad9bdb42263794d" + }, + { + "path": "kernels/edfa4ff396bf5cc3be28d9051639c4dda6fec1302d7a2bd34d89ec903af94af1.wgsl", + "byteLength": 307, + "sha256": "edfa4ff396bf5cc3be28d9051639c4dda6fec1302d7a2bd34d89ec903af94af1" + }, + { + "path": "kernels/eea033222d278c8aa8f4b0de36243adba4e5b6ce274d24a3dcd365ad42c19a38.wgsl", + "byteLength": 410, + "sha256": "eea033222d278c8aa8f4b0de36243adba4e5b6ce274d24a3dcd365ad42c19a38" + }, + { + "path": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl", + "byteLength": 849, + "sha256": "ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8" + }, + { + "path": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl", + "byteLength": 292, + "sha256": "ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284" + }, + { + "path": "kernels/efacc40901cd20fbccdbd5fff0b0b52af2860746708640ae1907d6be212f5f86.wgsl", + "byteLength": 660, + "sha256": "efacc40901cd20fbccdbd5fff0b0b52af2860746708640ae1907d6be212f5f86" + }, + { + "path": "kernels/efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b.wgsl", + "byteLength": 374, + "sha256": "efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b" + }, + { + "path": "kernels/f114c5cb9f1a7e377d9a3bcb28ab15b72807ece1796cf9c02fc74e7ce7318cc3.wgsl", + "byteLength": 341, + "sha256": "f114c5cb9f1a7e377d9a3bcb28ab15b72807ece1796cf9c02fc74e7ce7318cc3" + }, + { + "path": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl", + "byteLength": 322, + "sha256": "f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76" + }, + { + "path": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl", + "byteLength": 294, + "sha256": "f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2" + }, + { + "path": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl", + "byteLength": 561, + "sha256": "f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0" + }, + { + "path": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl", + "byteLength": 408, + "sha256": "f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537" + }, + { + "path": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl", + "byteLength": 310, + "sha256": "f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da" + }, + { + "path": "kernels/f43cdd9c75fc256957b1b144a0587e8c8ddea861f991e1cdb6c9098e8b5d6ed7.wgsl", + "byteLength": 394, + "sha256": "f43cdd9c75fc256957b1b144a0587e8c8ddea861f991e1cdb6c9098e8b5d6ed7" + }, + { + "path": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl", + "byteLength": 308, + "sha256": "f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658" + }, + { + "path": "kernels/f51f5d699193197f0dc7c2d586d727e8e41e465e70ef66e208e568c544524cf4.wgsl", + "byteLength": 411, + "sha256": "f51f5d699193197f0dc7c2d586d727e8e41e465e70ef66e208e568c544524cf4" + }, + { + "path": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl", + "byteLength": 371, + "sha256": "f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66" + }, + { + "path": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl", + "byteLength": 312, + "sha256": "f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690" + }, + { + "path": "kernels/f5f6f056866d42771d34664166a72300424224e9d6bd1d57de1805e7476a2050.wgsl", + "byteLength": 378, + "sha256": "f5f6f056866d42771d34664166a72300424224e9d6bd1d57de1805e7476a2050" + }, + { + "path": "kernels/f64c470f9333da8111720c1b00d9aa0e63ea21435bba9c9550e93a2c75c639bd.wgsl", + "byteLength": 1029, + "sha256": "f64c470f9333da8111720c1b00d9aa0e63ea21435bba9c9550e93a2c75c639bd" + }, + { + "path": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl", + "byteLength": 381, + "sha256": "f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039" + }, + { + "path": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl", + "byteLength": 296, + "sha256": "f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8" + }, + { + "path": "kernels/f73912607dffcf0ee27e9e1e1d342a3bef8f998e02cd06a8352524ef35a96d17.wgsl", + "byteLength": 599, + "sha256": "f73912607dffcf0ee27e9e1e1d342a3bef8f998e02cd06a8352524ef35a96d17" + }, + { + "path": "kernels/f84306aa81033babc4c37ecfb91a411dba2ccee17202615deefb2206add106e2.wgsl", + "byteLength": 367, + "sha256": "f84306aa81033babc4c37ecfb91a411dba2ccee17202615deefb2206add106e2" + }, + { + "path": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl", + "byteLength": 390, + "sha256": "f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964" + }, + { + "path": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl", + "byteLength": 408, + "sha256": "f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d" + }, + { + "path": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl", + "byteLength": 845, + "sha256": "f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19" + }, + { + "path": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl", + "byteLength": 396, + "sha256": "fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6" + }, + { + "path": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl", + "byteLength": 371, + "sha256": "fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953" + }, + { + "path": "kernels/fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb.wgsl", + "byteLength": 374, + "sha256": "fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb" + }, + { + "path": "kernels/fe3fa777b524c01e952170bce92075a5187a0830902e76f20a4ed6fe1980a144.wgsl", + "byteLength": 1521, + "sha256": "fe3fa777b524c01e952170bce92075a5187a0830902e76f20a4ed6fe1980a144" + }, + { + "path": "kernels/ff97954146b9a2a73ef2cfaa925f51254fc65b4eabcafb4ed57005054acd64b3.wgsl", + "byteLength": 663, + "sha256": "ff97954146b9a2a73ef2cfaa925f51254fc65b4eabcafb4ed57005054acd64b3" + }, + { + "path": "kernels/ffd61bbf56bbbbf8d09f9d601173f529b4c4039901ae92ddbbbf3aab411547a1.wgsl", + "byteLength": 656, + "sha256": "ffd61bbf56bbbbf8d09f9d601173f529b4c4039901ae92ddbbbf3aab411547a1" + } + ], + "metadata": { + "repository": "Qwen/Qwen3.5-2B", + "revision": "15852e8c16360a2fea060d615a32b45270f8a8fc", + "architecture": "qwen3_5", + "modalities": [ + "text" + ], + "license": "apache-2.0", + "sourceWeights": [ + { + "path": "model.safetensors-00001-of-00001.safetensors", + "sha256": "aa33250c4fc64891ddfaba3a314fd9542ea371843c387178b425fbcc5ed680b1" + } + ], + "profile": "fp32-int8-g32", + "prefill": "queued-incremental", + "checkpointCertified": false, + "fusion": true, + "quantizationSelection": { + "include": [], + "exclude": [] + } + }, + "validation": { + "checkpointCertified": false, + "hardware": [] + }, + "generation": { + "contextLength": 4096, + "inputIds": "input_ids", + "positionIds": "position_ids", + "attentionMask": "attention_mask", + "logits": "linear_186", + "eosTokenIds": [ + 248044 + ], + "tokenizer": "tokenizer/tokenizer.json", + "tokenizerConfig": "tokenizer/tokenizer_config.json", + "chatTemplate": "tokenizer/chat_template.jinja", + "prefillEntrypoints": { + "4": "prefill-4", + "16": "prefill-16", + "64": "prefill-64" + }, + "prefillDefault": true + } +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/LICENSE b/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/LICENSE new file mode 100644 index 0000000000000000000000000000000000000000..f938136e3adacfd92be087f6e113b5d6d97f678f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/LICENSE @@ -0,0 +1,202 @@ + + Apache License + Version 2.0, January 2004 + http://www.apache.org/licenses/ + + TERMS AND CONDITIONS FOR USE, REPRODUCTION, AND DISTRIBUTION + + 1. Definitions. + + "License" shall mean the terms and conditions for use, reproduction, + and distribution as defined by Sections 1 through 9 of this document. + + "Licensor" shall mean the copyright owner or entity authorized by + the copyright owner that is granting the License. + + "Legal Entity" shall mean the union of the acting entity and all + other entities that control, are controlled by, or are under common + control with that entity. For the purposes of this definition, + "control" means (i) the power, direct or indirect, to cause the + direction or management of such entity, whether by contract or + otherwise, or (ii) ownership of fifty percent (50%) or more of the + outstanding shares, or (iii) beneficial ownership of such entity. + + "You" (or "Your") shall mean an individual or Legal Entity + exercising permissions granted by this License. + + "Source" form shall mean the preferred form for making modifications, + including but not limited to software source code, documentation + source, and configuration files. + + "Object" form shall mean any form resulting from mechanical + transformation or translation of a Source form, including but + not limited to compiled object code, generated documentation, + and conversions to other media types. + + "Work" shall mean the work of authorship, whether in Source or + Object form, made available under the License, as indicated by a + copyright notice that is included in or attached to the work + (an example is provided in the Appendix below). + + "Derivative Works" shall mean any work, whether in Source or Object + form, that is based on (or derived from) the Work and for which the + editorial revisions, annotations, elaborations, or other modifications + represent, as a whole, an original work of authorship. For the purposes + of this License, Derivative Works shall not include works that remain + separable from, or merely link (or bind by name) to the interfaces of, + the Work and Derivative Works thereof. + + "Contribution" shall mean any work of authorship, including + the original version of the Work and any modifications or additions + to that Work or Derivative Works thereof, that is intentionally + submitted to Licensor for inclusion in the Work by the copyright owner + or by an individual or Legal Entity authorized to submit on behalf of + the copyright owner. For the purposes of this definition, "submitted" + means any form of electronic, verbal, or written communication sent + to the Licensor or its representatives, including but not limited to + communication on electronic mailing lists, source code control systems, + and issue tracking systems that are managed by, or on behalf of, the + Licensor for the purpose of discussing and improving the Work, but + excluding communication that is conspicuously marked or otherwise + designated in writing by the copyright owner as "Not a Contribution." + + "Contributor" shall mean Licensor and any individual or Legal Entity + on behalf of whom a Contribution has been received by Licensor and + subsequently incorporated within the Work. + + 2. Grant of Copyright License. Subject to the terms and conditions of + this License, each Contributor hereby grants to You a perpetual, + worldwide, non-exclusive, no-charge, royalty-free, irrevocable + copyright license to reproduce, prepare Derivative Works of, + publicly display, publicly perform, sublicense, and distribute the + Work and such Derivative Works in Source or Object form. + + 3. Grant of Patent License. Subject to the terms and conditions of + this License, each Contributor hereby grants to You a perpetual, + worldwide, non-exclusive, no-charge, royalty-free, irrevocable + (except as stated in this section) patent license to make, have made, + use, offer to sell, sell, import, and otherwise transfer the Work, + where such license applies only to those patent claims licensable + by such Contributor that are necessarily infringed by their + Contribution(s) alone or by combination of their Contribution(s) + with the Work to which such Contribution(s) was submitted. If You + institute patent litigation against any entity (including a + cross-claim or counterclaim in a lawsuit) alleging that the Work + or a Contribution incorporated within the Work constitutes direct + or contributory patent infringement, then any patent licenses + granted to You under this License for that Work shall terminate + as of the date such litigation is filed. + + 4. Redistribution. You may reproduce and distribute copies of the + Work or Derivative Works thereof in any medium, with or without + modifications, and in Source or Object form, provided that You + meet the following conditions: + + (a) You must give any other recipients of the Work or + Derivative Works a copy of this License; and + + (b) You must cause any modified files to carry prominent notices + stating that You changed the files; and + + (c) You must retain, in the Source form of any Derivative Works + that You distribute, all copyright, patent, trademark, and + attribution notices from the Source form of the Work, + excluding those notices that do not pertain to any part of + the Derivative Works; and + + (d) If the Work includes a "NOTICE" text file as part of its + distribution, then any Derivative Works that You distribute must + include a readable copy of the attribution notices contained + within such NOTICE file, excluding those notices that do not + pertain to any part of the Derivative Works, in at least one + of the following places: within a NOTICE text file distributed + as part of the Derivative Works; within the Source form or + documentation, if provided along with the Derivative Works; or, + within a display generated by the Derivative Works, if and + wherever such third-party notices normally appear. The contents + of the NOTICE file are for informational purposes only and + do not modify the License. You may add Your own attribution + notices within Derivative Works that You distribute, alongside + or as an addendum to the NOTICE text from the Work, provided + that such additional attribution notices cannot be construed + as modifying the License. + + You may add Your own copyright statement to Your modifications and + may provide additional or different license terms and conditions + for use, reproduction, or distribution of Your modifications, or + for any such Derivative Works as a whole, provided Your use, + reproduction, and distribution of the Work otherwise complies with + the conditions stated in this License. + + 5. Submission of Contributions. Unless You explicitly state otherwise, + any Contribution intentionally submitted for inclusion in the Work + by You to the Licensor shall be under the terms and conditions of + this License, without any additional terms or conditions. + Notwithstanding the above, nothing herein shall supersede or modify + the terms of any separate license agreement you may have executed + with Licensor regarding such Contributions. + + 6. Trademarks. This License does not grant permission to use the trade + names, trademarks, service marks, or product names of the Licensor, + except as required for reasonable and customary use in describing the + origin of the Work and reproducing the content of the NOTICE file. + + 7. Disclaimer of Warranty. Unless required by applicable law or + agreed to in writing, Licensor provides the Work (and each + Contributor provides its Contributions) on an "AS IS" BASIS, + WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or + implied, including, without limitation, any warranties or conditions + of TITLE, NON-INFRINGEMENT, MERCHANTABILITY, or FITNESS FOR A + PARTICULAR PURPOSE. You are solely responsible for determining the + appropriateness of using or redistributing the Work and assume any + risks associated with Your exercise of permissions under this License. + + 8. Limitation of Liability. In no event and under no legal theory, + whether in tort (including negligence), contract, or otherwise, + unless required by applicable law (such as deliberate and grossly + negligent acts) or agreed to in writing, shall any Contributor be + liable to You for damages, including any direct, indirect, special, + incidental, or consequential damages of any character arising as a + result of this License or out of the use or inability to use the + Work (including but not limited to damages for loss of goodwill, + work stoppage, computer failure or malfunction, or any and all + other commercial damages or losses), even if such Contributor + has been advised of the possibility of such damages. + + 9. Accepting Warranty or Additional Liability. While redistributing + the Work or Derivative Works thereof, You may choose to offer, + and charge a fee for, acceptance of support, warranty, indemnity, + or other liability obligations and/or rights consistent with this + License. However, in accepting such obligations, You may act only + on Your own behalf and on Your sole responsibility, not on behalf + of any other Contributor, and only if You agree to indemnify, + defend, and hold each Contributor harmless for any liability + incurred by, or claims asserted against, such Contributor by reason + of your accepting any such warranty or additional liability. + + END OF TERMS AND CONDITIONS + + APPENDIX: How to apply the Apache License to your work. + + To apply the Apache License to your work, attach the following + boilerplate notice, with the fields enclosed by brackets "[]" + replaced with your own identifying information. (Don't include + the brackets!) The text should be enclosed in the appropriate + comment syntax for the file format. We also recommend that a + file or class name and description of purpose be included on the + same "printed page" as the copyright notice for easier + identification within third-party archives. + + Copyright 2026 Alibaba Cloud + + Licensed under the Apache License, Version 2.0 (the "License"); + you may not use this file except in compliance with the License. + You may obtain a copy of the License at + + http://www.apache.org/licenses/LICENSE-2.0 + + Unless required by applicable law or agreed to in writing, software + distributed under the License is distributed on an "AS IS" BASIS, + WITHOUT WARRANTIES OR CONDITIONS OF ANY KIND, either express or implied. + See the License for the specific language governing permissions and + limitations under the License. \ No newline at end of file diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/config.json b/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/config.json new file mode 100644 index 0000000000000000000000000000000000000000..d30a15be1bbfd610f58ad80f1fbeb6778f58a80f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/config.json @@ -0,0 +1,96 @@ +{ + "architectures": [ + "Qwen3_5ForConditionalGeneration" + ], + "image_token_id": 248056, + "model_type": "qwen3_5", + "text_config": { + "attention_bias": false, + "attention_dropout": 0.0, + "attn_output_gate": true, + "dtype": "bfloat16", + "eos_token_id": 248044, + "full_attention_interval": 4, + "head_dim": 256, + "hidden_act": "silu", + "hidden_size": 2048, + "initializer_range": 0.02, + "intermediate_size": 6144, + "layer_types": [ + "linear_attention", + "linear_attention", + "linear_attention", + "full_attention", + "linear_attention", + "linear_attention", + "linear_attention", + "full_attention", + "linear_attention", + "linear_attention", + "linear_attention", + "full_attention", + "linear_attention", + "linear_attention", + "linear_attention", + "full_attention", + "linear_attention", + "linear_attention", + "linear_attention", + "full_attention", + "linear_attention", + "linear_attention", + "linear_attention", + "full_attention" + ], + "linear_conv_kernel_dim": 4, + "linear_key_head_dim": 128, + "linear_num_key_heads": 16, + "linear_num_value_heads": 16, + "linear_value_head_dim": 128, + "max_position_embeddings": 262144, + "mlp_only_layers": [], + "model_type": "qwen3_5_text", + "mtp_num_hidden_layers": 1, + "mtp_use_dedicated_embeddings": false, + "num_attention_heads": 8, + "num_hidden_layers": 24, + "num_key_value_heads": 2, + "rms_norm_eps": 1e-06, + "tie_word_embeddings": true, + "use_cache": true, + "vocab_size": 248320, + "mamba_ssm_dtype": "float32", + "rope_parameters": { + "mrope_interleaved": true, + "mrope_section": [ + 11, + 11, + 10 + ], + "rope_type": "default", + "rope_theta": 10000000, + "partial_rotary_factor": 0.25 + } + }, + "tie_word_embeddings": true, + "transformers_version": "4.57.0.dev0", + "video_token_id": 248057, + "vision_config": { + "deepstack_visual_indexes": [], + "depth": 24, + "hidden_act": "gelu_pytorch_tanh", + "hidden_size": 1024, + "in_channels": 3, + "initializer_range": 0.02, + "intermediate_size": 4096, + "model_type": "qwen3_5", + "num_heads": 16, + "num_position_embeddings": 2304, + "out_hidden_size": 2048, + "patch_size": 16, + "spatial_merge_size": 2, + "temporal_patch_size": 2 + }, + "vision_end_token_id": 248054, + "vision_start_token_id": 248053 +} \ No newline at end of file diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/provenance.json b/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/provenance.json new file mode 100644 index 0000000000000000000000000000000000000000..bd55bbf10d67cc58ce3615adcf96ca766aedd5a3 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/source/provenance.json @@ -0,0 +1,10 @@ +{ + "repository": "Qwen/Qwen3.5-2B", + "revision": "15852e8c16360a2fea060d615a32b45270f8a8fc", + "architecture": "qwen3_5", + "modalities": [ + "text", + "image" + ], + "license": "apache-2.0" +} diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/chat_template.jinja b/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/chat_template.jinja new file mode 100644 index 0000000000000000000000000000000000000000..0ef09f214eaa6d9bca297988afc1454b5827b2c7 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/chat_template.jinja @@ -0,0 +1,154 @@ +{%- set image_count = namespace(value=0) %} +{%- set video_count = namespace(value=0) %} +{%- macro render_content(content, do_vision_count, is_system_content=false) %} + {%- if content is string %} + {{- content }} + {%- elif content is iterable and content is not mapping %} + {%- for item in content %} + {%- if 'image' in item or 'image_url' in item or item.type == 'image' %} + {%- if is_system_content %} + {{- raise_exception('System message cannot contain images.') }} + {%- endif %} + {%- if do_vision_count %} + {%- set image_count.value = image_count.value + 1 %} + {%- endif %} + {%- if add_vision_id %} + {{- 'Picture ' ~ image_count.value ~ ': ' }} + {%- endif %} + {{- '<|vision_start|><|image_pad|><|vision_end|>' }} + {%- elif 'video' in item or item.type == 'video' %} + {%- if is_system_content %} + {{- raise_exception('System message cannot contain videos.') }} + {%- endif %} + {%- if do_vision_count %} + {%- set video_count.value = video_count.value + 1 %} + {%- endif %} + {%- if add_vision_id %} + {{- 'Video ' ~ video_count.value ~ ': ' }} + {%- endif %} + {{- '<|vision_start|><|video_pad|><|vision_end|>' }} + {%- elif 'text' in item %} + {{- item.text }} + {%- else %} + {{- raise_exception('Unexpected item type in content.') }} + {%- endif %} + {%- endfor %} + {%- elif content is none or content is undefined %} + {{- '' }} + {%- else %} + {{- raise_exception('Unexpected content type.') }} + {%- endif %} +{%- endmacro %} +{%- if not messages %} + {{- raise_exception('No messages provided.') }} +{%- endif %} +{%- if tools and tools is iterable and tools is not mapping %} + {{- '<|im_start|>system\n' }} + {{- "# Tools\n\nYou have access to the following functions:\n\n" }} + {%- for tool in tools %} + {{- "\n" }} + {{- tool | tojson }} + {%- endfor %} + {{- "\n" }} + {{- '\n\nIf you choose to call a function ONLY reply in the following format with NO suffix:\n\n\n\n\nvalue_1\n\n\nThis is the value for the second parameter\nthat can span\nmultiple lines\n\n\n\n\n\nReminder:\n- Function calls MUST follow the specified format: an inner block must be nested within XML tags\n- Required parameters MUST be specified\n- You may provide optional reasoning for your function call in natural language BEFORE the function call, but NOT after\n- If there is no function call available, answer the question like normal with your current knowledge and do not tell the user about function calls\n' }} + {%- if messages[0].role == 'system' %} + {%- set content = render_content(messages[0].content, false, true)|trim %} + {%- if content %} + {{- '\n\n' + content }} + {%- endif %} + {%- endif %} + {{- '<|im_end|>\n' }} +{%- else %} + {%- if messages[0].role == 'system' %} + {%- set content = render_content(messages[0].content, false, true)|trim %} + {{- '<|im_start|>system\n' + content + '<|im_end|>\n' }} + {%- endif %} +{%- endif %} +{%- set ns = namespace(multi_step_tool=true, last_query_index=messages|length - 1) %} +{%- for message in messages[::-1] %} + {%- set index = (messages|length - 1) - loop.index0 %} + {%- if ns.multi_step_tool and message.role == "user" %} + {%- set content = render_content(message.content, false)|trim %} + {%- if not(content.startswith('') and content.endswith('')) %} + {%- set ns.multi_step_tool = false %} + {%- set ns.last_query_index = index %} + {%- endif %} + {%- endif %} +{%- endfor %} +{%- if ns.multi_step_tool %} + {{- raise_exception('No user query found in messages.') }} +{%- endif %} +{%- for message in messages %} + {%- set content = render_content(message.content, true)|trim %} + {%- if message.role == "system" %} + {%- if not loop.first %} + {{- raise_exception('System message must be at the beginning.') }} + {%- endif %} + {%- elif message.role == "user" %} + {{- '<|im_start|>' + message.role + '\n' + content + '<|im_end|>' + '\n' }} + {%- elif message.role == "assistant" %} + {%- set reasoning_content = '' %} + {%- if message.reasoning_content is string %} + {%- set reasoning_content = message.reasoning_content %} + {%- else %} + {%- if '' in content %} + {%- set reasoning_content = content.split('')[0].rstrip('\n').split('')[-1].lstrip('\n') %} + {%- set content = content.split('')[-1].lstrip('\n') %} + {%- endif %} + {%- endif %} + {%- set reasoning_content = reasoning_content|trim %} + {%- if loop.index0 > ns.last_query_index %} + {{- '<|im_start|>' + message.role + '\n\n' + reasoning_content + '\n\n\n' + content }} + {%- else %} + {{- '<|im_start|>' + message.role + '\n' + content }} + {%- endif %} + {%- if message.tool_calls and message.tool_calls is iterable and message.tool_calls is not mapping %} + {%- for tool_call in message.tool_calls %} + {%- if tool_call.function is defined %} + {%- set tool_call = tool_call.function %} + {%- endif %} + {%- if loop.first %} + {%- if content|trim %} + {{- '\n\n\n\n' }} + {%- else %} + {{- '\n\n' }} + {%- endif %} + {%- else %} + {{- '\n\n\n' }} + {%- endif %} + {%- if tool_call.arguments is defined %} + {%- for args_name, args_value in tool_call.arguments|items %} + {{- '\n' }} + {%- set args_value = args_value | tojson | safe if args_value is mapping or (args_value is sequence and args_value is not string) else args_value | string %} + {{- args_value }} + {{- '\n\n' }} + {%- endfor %} + {%- endif %} + {{- '\n' }} + {%- endfor %} + {%- endif %} + {{- '<|im_end|>\n' }} + {%- elif message.role == "tool" %} + {%- if loop.previtem and loop.previtem.role != "tool" %} + {{- '<|im_start|>user' }} + {%- endif %} + {{- '\n\n' }} + {{- content }} + {{- '\n' }} + {%- if not loop.last and loop.nextitem.role != "tool" %} + {{- '<|im_end|>\n' }} + {%- elif loop.last %} + {{- '<|im_end|>\n' }} + {%- endif %} + {%- else %} + {{- raise_exception('Unexpected message role.') }} + {%- endif %} +{%- endfor %} +{%- if add_generation_prompt %} + {{- '<|im_start|>assistant\n' }} + {%- if enable_thinking is defined and enable_thinking is true %} + {{- '\n' }} + {%- else %} + {{- '\n\n\n\n' }} + {%- endif %} +{%- endif %} \ No newline at end of file diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer.json b/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer.json new file mode 100644 index 0000000000000000000000000000000000000000..a73a846725794819aa6e1c9e97d8dc9671c2006d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer.json @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5f9e4d4901a92b997e463c1f46055088b6cca5ca61a6522d1b9f64c4bb81cb42 +size 12807982 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer_config.json b/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer_config.json new file mode 100644 index 0000000000000000000000000000000000000000..fae3ce993e07c092ad024dde45e592379fde91bb --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/tokenizer/tokenizer_config.json @@ -0,0 +1,305 @@ +{ + "add_prefix_space": false, + "added_tokens_decoder": { + "248044": { + "content": "<|endoftext|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248045": { + "content": "<|im_start|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248046": { + "content": "<|im_end|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248047": { + "content": "<|object_ref_start|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248048": { + "content": "<|object_ref_end|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248049": { + "content": "<|box_start|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248050": { + "content": "<|box_end|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248051": { + "content": "<|quad_start|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248052": { + "content": "<|quad_end|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248053": { + "content": "<|vision_start|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248054": { + "content": "<|vision_end|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248055": { + "content": "<|vision_pad|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248056": { + "content": "<|image_pad|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248057": { + "content": "<|video_pad|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248058": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248059": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248060": { + "content": "<|fim_prefix|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248061": { + "content": "<|fim_middle|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248062": { + "content": "<|fim_suffix|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248063": { + "content": "<|fim_pad|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248064": { + "content": "<|repo_name|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248065": { + "content": "<|file_sep|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248066": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248067": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248068": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248069": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": false + }, + "248070": { + "content": "<|audio_start|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248071": { + "content": "<|audio_end|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248072": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248073": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248074": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248075": { + "content": "", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + }, + "248076": { + "content": "<|audio_pad|>", + "lstrip": false, + "normalized": false, + "rstrip": false, + "single_word": false, + "special": true + } + }, + "additional_special_tokens": [ + "<|im_start|>", + "<|im_end|>", + "<|object_ref_start|>", + "<|object_ref_end|>", + "<|box_start|>", + "<|box_end|>", + "<|quad_start|>", + "<|quad_end|>", + "<|vision_start|>", + "<|vision_end|>", + "<|vision_pad|>", + "<|image_pad|>", + "<|video_pad|>" + ], + "bos_token": null, + "chat_template": "{%- set image_count = namespace(value=0) %}\n{%- set video_count = namespace(value=0) %}\n{%- macro render_content(content, do_vision_count, is_system_content=false) %}\n {%- if content is string %}\n {{- content }}\n {%- elif content is iterable and content is not mapping %}\n {%- for item in content %}\n {%- if 'image' in item or 'image_url' in item or item.type == 'image' %}\n {%- if is_system_content %}\n {{- raise_exception('System message cannot contain images.') }}\n {%- endif %}\n {%- if do_vision_count %}\n {%- set image_count.value = image_count.value + 1 %}\n {%- endif %}\n {%- if add_vision_id %}\n {{- 'Picture ' ~ image_count.value ~ ': ' }}\n {%- endif %}\n {{- '<|vision_start|><|image_pad|><|vision_end|>' }}\n {%- elif 'video' in item or item.type == 'video' %}\n {%- if is_system_content %}\n {{- raise_exception('System message cannot contain videos.') }}\n {%- endif %}\n {%- if do_vision_count %}\n {%- set video_count.value = video_count.value + 1 %}\n {%- endif %}\n {%- if add_vision_id %}\n {{- 'Video ' ~ video_count.value ~ ': ' }}\n {%- endif %}\n {{- '<|vision_start|><|video_pad|><|vision_end|>' }}\n {%- elif 'text' in item %}\n {{- item.text }}\n {%- else %}\n {{- raise_exception('Unexpected item type in content.') }}\n {%- endif %}\n {%- endfor %}\n {%- elif content is none or content is undefined %}\n {{- '' }}\n {%- else %}\n {{- raise_exception('Unexpected content type.') }}\n {%- endif %}\n{%- endmacro %}\n{%- if not messages %}\n {{- raise_exception('No messages provided.') }}\n{%- endif %}\n{%- if tools and tools is iterable and tools is not mapping %}\n {{- '<|im_start|>system\\n' }}\n {{- \"# Tools\\n\\nYou have access to the following functions:\\n\\n\" }}\n {%- for tool in tools %}\n {{- \"\\n\" }}\n {{- tool | tojson }}\n {%- endfor %}\n {{- \"\\n\" }}\n {{- '\\n\\nIf you choose to call a function ONLY reply in the following format with NO suffix:\\n\\n\\n\\n\\nvalue_1\\n\\n\\nThis is the value for the second parameter\\nthat can span\\nmultiple lines\\n\\n\\n\\n\\n\\nReminder:\\n- Function calls MUST follow the specified format: an inner block must be nested within XML tags\\n- Required parameters MUST be specified\\n- You may provide optional reasoning for your function call in natural language BEFORE the function call, but NOT after\\n- If there is no function call available, answer the question like normal with your current knowledge and do not tell the user about function calls\\n' }}\n {%- if messages[0].role == 'system' %}\n {%- set content = render_content(messages[0].content, false, true)|trim %}\n {%- if content %}\n {{- '\\n\\n' + content }}\n {%- endif %}\n {%- endif %}\n {{- '<|im_end|>\\n' }}\n{%- else %}\n {%- if messages[0].role == 'system' %}\n {%- set content = render_content(messages[0].content, false, true)|trim %}\n {{- '<|im_start|>system\\n' + content + '<|im_end|>\\n' }}\n {%- endif %}\n{%- endif %}\n{%- set ns = namespace(multi_step_tool=true, last_query_index=messages|length - 1) %}\n{%- for message in messages[::-1] %}\n {%- set index = (messages|length - 1) - loop.index0 %}\n {%- if ns.multi_step_tool and message.role == \"user\" %}\n {%- set content = render_content(message.content, false)|trim %}\n {%- if not(content.startswith('') and content.endswith('')) %}\n {%- set ns.multi_step_tool = false %}\n {%- set ns.last_query_index = index %}\n {%- endif %}\n {%- endif %}\n{%- endfor %}\n{%- if ns.multi_step_tool %}\n {{- raise_exception('No user query found in messages.') }}\n{%- endif %}\n{%- for message in messages %}\n {%- set content = render_content(message.content, true)|trim %}\n {%- if message.role == \"system\" %}\n {%- if not loop.first %}\n {{- raise_exception('System message must be at the beginning.') }}\n {%- endif %}\n {%- elif message.role == \"user\" %}\n {{- '<|im_start|>' + message.role + '\\n' + content + '<|im_end|>' + '\\n' }}\n {%- elif message.role == \"assistant\" %}\n {%- set reasoning_content = '' %}\n {%- if message.reasoning_content is string %}\n {%- set reasoning_content = message.reasoning_content %}\n {%- else %}\n {%- if '' in content %}\n {%- set reasoning_content = content.split('')[0].rstrip('\\n').split('')[-1].lstrip('\\n') %}\n {%- set content = content.split('')[-1].lstrip('\\n') %}\n {%- endif %}\n {%- endif %}\n {%- set reasoning_content = reasoning_content|trim %}\n {%- if loop.index0 > ns.last_query_index %}\n {{- '<|im_start|>' + message.role + '\\n\\n' + reasoning_content + '\\n\\n\\n' + content }}\n {%- else %}\n {{- '<|im_start|>' + message.role + '\\n' + content }}\n {%- endif %}\n {%- if message.tool_calls and message.tool_calls is iterable and message.tool_calls is not mapping %}\n {%- for tool_call in message.tool_calls %}\n {%- if tool_call.function is defined %}\n {%- set tool_call = tool_call.function %}\n {%- endif %}\n {%- if loop.first %}\n {%- if content|trim %}\n {{- '\\n\\n\\n\\n' }}\n {%- else %}\n {{- '\\n\\n' }}\n {%- endif %}\n {%- else %}\n {{- '\\n\\n\\n' }}\n {%- endif %}\n {%- if tool_call.arguments is defined %}\n {%- for args_name, args_value in tool_call.arguments|items %}\n {{- '\\n' }}\n {%- set args_value = args_value | tojson | safe if args_value is mapping or (args_value is sequence and args_value is not string) else args_value | string %}\n {{- args_value }}\n {{- '\\n\\n' }}\n {%- endfor %}\n {%- endif %}\n {{- '\\n' }}\n {%- endfor %}\n {%- endif %}\n {{- '<|im_end|>\\n' }}\n {%- elif message.role == \"tool\" %}\n {%- if loop.previtem and loop.previtem.role != \"tool\" %}\n {{- '<|im_start|>user' }}\n {%- endif %}\n {{- '\\n\\n' }}\n {{- content }}\n {{- '\\n' }}\n {%- if not loop.last and loop.nextitem.role != \"tool\" %}\n {{- '<|im_end|>\\n' }}\n {%- elif loop.last %}\n {{- '<|im_end|>\\n' }}\n {%- endif %}\n {%- else %}\n {{- raise_exception('Unexpected message role.') }}\n {%- endif %}\n{%- endfor %}\n{%- if add_generation_prompt %}\n {{- '<|im_start|>assistant\\n' }}\n {%- if enable_thinking is defined and enable_thinking is true %}\n {{- '\\n' }}\n {%- else %}\n {{- '\\n\\n\\n\\n' }}\n {%- endif %}\n{%- endif %}", + "clean_up_tokenization_spaces": false, + "eos_token": "<|im_end|>", + "errors": "replace", + "model_max_length": 262144, + "pad_token": "<|endoftext|>", + "split_special_tokens": false, + "tokenizer_class": "Qwen2Tokenizer", + "unk_token": null, + "add_bos_token": false, + "pretokenize_regex": "(?i:'s|'t|'re|'ve|'m|'ll|'d)|[^\\r\\n\\p{L}\\p{N}]?[\\p{L}\\p{M}]+|\\p{N}| ?[^\\s\\p{L}\\p{M}\\p{N}]+[\\r\\n]*|\\s*[\\r\\n]+|\\s+(?!\\S)|\\s+", + "extra_special_tokens": { + "audio_bos_token": "<|audio_start|>", + "audio_eos_token": "<|audio_end|>", + "audio_token": "<|audio_pad|>", + "image_token": "<|image_pad|>", + "video_token": "<|video_pad|>", + "vision_bos_token": "<|vision_start|>", + "vision_eos_token": "<|vision_end|>" + } +} \ No newline at end of file diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00000.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00000.bin new file mode 100644 index 0000000000000000000000000000000000000000..cbd614c29160d261f1aaf53fc5f2db30e6e85966 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00000.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:84ffbe4377ff841ace0fd11d616bc3466b93dcf57d52517ca8840997f19eb4c6 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00001.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00001.bin new file mode 100644 index 0000000000000000000000000000000000000000..af4e09326541e5fd5c48481b4d60116910f78e58 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00001.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:30bde451b91aff2928cffe4865bbc86dbdea76dd6e4af4467d692d3f474a4e8d +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00002.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00002.bin new file mode 100644 index 0000000000000000000000000000000000000000..a65f269fcf8eb96cd7edac019ca903bdf7fdc457 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00002.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2a48e75076e26169bd4285f359d0288716ebcdb123b1f79ebe66d7744e74ecc4 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00003.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00003.bin new file mode 100644 index 0000000000000000000000000000000000000000..e84fbcf345c2c0528ce0ca09eacbcce63ba4cfaa --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00003.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:d586da92796726ab87caabd21324b47f5332b0daad223a1322d1a5e75a276489 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00004.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00004.bin new file mode 100644 index 0000000000000000000000000000000000000000..7faebe0c9cb439352ac01ce287563debc1a48ee8 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00004.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:8615920b4bd70b2e1c379f78d8fd2a3b454d7e1aa4db6ce5fda24b64e0b57c3a +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00005.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00005.bin new file mode 100644 index 0000000000000000000000000000000000000000..b28a16e4c4fdbbda6ce73d58892473b572fa97fc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00005.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5da61ce89024c8030b4efb637f69cdb77189724dcd9f7da9b987a7fb92a510a9 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00006.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00006.bin new file mode 100644 index 0000000000000000000000000000000000000000..2f29a48c718d0b980602a37dfaf26f748319d88c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00006.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:213bb58a0acf92bc272be0a009c1c660375cfcbea1525ef81a191efcd3a32ee0 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00007.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00007.bin new file mode 100644 index 0000000000000000000000000000000000000000..698188c73825cf12006072b0624cd43c1fc09dbf --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00007.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e48c21b8fd01fd6eee6b534eba62c0c7285963b5c18391b1c854fbfee0c0c21b +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00008.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00008.bin new file mode 100644 index 0000000000000000000000000000000000000000..e62b29d9e8a55705c892265d7015094e2d1a48db --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00008.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:b45e3336fac9353a2b90a731184c0a725fe0bf4b4f6c1cdcfd5d4e2d8f5f3849 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00009.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00009.bin new file mode 100644 index 0000000000000000000000000000000000000000..1e66c997b83f3c5e25de092ae26a83e57879007a --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00009.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:097d3ef6aed94a420d026323d9e43f07730289dd1a9fe22bdeae57d76b84f0b6 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00010.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00010.bin new file mode 100644 index 0000000000000000000000000000000000000000..b20954ff1d9a5ad9982b133d4bf3eabb45b41b3e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00010.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e1b9904b4ef7840fedc8badd04438db0d7b9e7baadafe8931534c8801438a11f +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00011.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00011.bin new file mode 100644 index 0000000000000000000000000000000000000000..181c178f2d0051162d863f32af8266dbf5b6ae57 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00011.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:7b52d09d0ce3fa311c4e08c9e6aded6bd20d221461f44aa6305a39e9c098b578 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00012.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00012.bin new file mode 100644 index 0000000000000000000000000000000000000000..ccfb96d7e1a55ddb5724001886b1ab1237b00a3f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00012.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5193cee36808d007e7b7bdd958e49c0a3c30f99be53cdc163396553201b7a652 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00013.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00013.bin new file mode 100644 index 0000000000000000000000000000000000000000..8e08adca607c63ad161b3fad7a924ce438eb1e65 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00013.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:5c82b1141090140d5899e34a0d87c3d4f570a5e1d92d39f2c7adb0ae49aacdef +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00014.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00014.bin new file mode 100644 index 0000000000000000000000000000000000000000..8f4e0b9a2080242f7db78caa15acdcf849431731 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00014.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:bea09d102c10e33637d240a9e420c57bcb5cbf2d241c05ae2b07cf5ac0984b4d +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00015.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00015.bin new file mode 100644 index 0000000000000000000000000000000000000000..17d7da399afc3b0e1a911ba5e32c544e4e60090d --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00015.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e03e9ea691d0b5ceeb2fe8b5be66d5c093e844e9a9c66419d39b5896b4e01319 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00016.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00016.bin new file mode 100644 index 0000000000000000000000000000000000000000..b840bcae07d34f5b55b31d79944243888abd33cd --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00016.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:fe8254c59393a562809ecd57c8aa80b009fc6ebe2eadc434582a4f2747eaeb65 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00017.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00017.bin new file mode 100644 index 0000000000000000000000000000000000000000..d3ec4af2dcf9000321a3058470a862621e152625 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00017.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:57148cd4031dbb9e4c797bec29e94bce34196bd99cc466caf4f473994c3cfb37 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00018.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00018.bin new file mode 100644 index 0000000000000000000000000000000000000000..1471835022e84bc4cd50eefc594d6e2a4e4b90ff --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00018.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e4de09f17f8c15e27c06eaaf2e69885efd837192a5d14a0d5a99c93d516faf5f +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00019.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00019.bin new file mode 100644 index 0000000000000000000000000000000000000000..dcf76babc4bbc458b93d2741d2181cfb8c3c573f --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00019.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:76dda70376dfa5539aa9adf093bbe00f1c91b9b621c314764d334a162f7d103b +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00020.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00020.bin new file mode 100644 index 0000000000000000000000000000000000000000..88f4b5dd6a47d94522ad209b12c4f5e37177301e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00020.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:839854fef54645505fdb821f02eccc9cc4755c21cf4fde4b2a3692c33a59a05a +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00021.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00021.bin new file mode 100644 index 0000000000000000000000000000000000000000..fe1d10b9efbf11b4ae8d5125b819b66ac59073f6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00021.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:da273605fc35f886d3ec8cc88e6d84be37e32dfc267b81d7bcbdbf6506bbb514 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00022.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00022.bin new file mode 100644 index 0000000000000000000000000000000000000000..fb4cc46e630d8a9934a209a865df8ce1f70e6440 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00022.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3398ef4c2270c78071273def3c5b519e7651b98cd19be8d9745f5b7b86fcf810 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00023.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00023.bin new file mode 100644 index 0000000000000000000000000000000000000000..bbb489ab63b28a57f10813e5f8e7959abf144e57 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00023.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:c457d355150fa70df57f93ed3f089e73cefec891058b04a470a18d033e1ceed2 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00024.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00024.bin new file mode 100644 index 0000000000000000000000000000000000000000..89a513f48c46684a72a640a774dd7139a156d262 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00024.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:74aecb320090f02b1f1b77dad4f84befcbfa55c85ff55e456f349ef2a29bbd9b +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00025.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00025.bin new file mode 100644 index 0000000000000000000000000000000000000000..c39fd52cba2611cecdaf0f8b942935434b269fbe --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00025.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:a61b2a95ceb63bc80bbc226deb31bb8e12f9b714edfcfa4e49af5132a49fbb31 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00026.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00026.bin new file mode 100644 index 0000000000000000000000000000000000000000..f156beb8ca279d39e7fbfc40156c5605397de7d6 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00026.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:2d6ffa605c0cde049237233841ebe39208460711fd19f719923c964d049fe8be +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00027.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00027.bin new file mode 100644 index 0000000000000000000000000000000000000000..f204035d279fa9982d788af7e55501a85ffd5e08 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00027.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:28cf84c4ab75575f251099f433618050dfd28f4866d39dfac450beaf6af020d4 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00028.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00028.bin new file mode 100644 index 0000000000000000000000000000000000000000..71fdafc1bafca8b37a3bbd8a15d3b30bd8e1bc23 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00028.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:6c42953eecb293a4bcf06d43804e72eaa01b4e38e90fe4f6d218f9941068169d +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00029.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00029.bin new file mode 100644 index 0000000000000000000000000000000000000000..ae933071ca9ee463e30616a9b47bc43b2ef368c5 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00029.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:e2aae91d0dc2c6391ee39ef03769370eb3d2c91ecd98bc4a5d6035452ef15204 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00030.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00030.bin new file mode 100644 index 0000000000000000000000000000000000000000..13fab89817aa998e6eb7e84223d450f51244badc --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00030.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:ccf4f0815f5dcd4cf81d97e45d962e3b42f19c8126f1eba098919b07f6805b01 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00031.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00031.bin new file mode 100644 index 0000000000000000000000000000000000000000..cf3ff0a8645f7a90a67e37226aeaa78e7ef3cd40 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00031.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:f2314e1a9519f3bad9f55abd2c3cbea7406dc112aa43cc1aea123d1e60b21371 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00032.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00032.bin new file mode 100644 index 0000000000000000000000000000000000000000..83a78399a65b43f49b08aac02a3d1f50f82a5587 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00032.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:be9ecb7b60b27697aec52b3c8745ba4f836c5e7942cb20b4c0dd8bb7529d8119 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00033.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00033.bin new file mode 100644 index 0000000000000000000000000000000000000000..f79181508fc902da6dfcde3670437d33f0e372c7 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00033.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:3d425053cc8ffcee7b92b4e680eb7b562c31759e39d71c64a02348a36bed6e4b +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00034.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00034.bin new file mode 100644 index 0000000000000000000000000000000000000000..2444c02a183bc9b86f31ec3ac9b8f435b1dff66c --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00034.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:18e6bbaa9d1daa2888815ec2d86db4151750a0870ad08ef54d44e85842f4576a +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00035.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00035.bin new file mode 100644 index 0000000000000000000000000000000000000000..8104db2e3972fc130de193d4922870671c1e69d9 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00035.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:11fc5d9bbf3010c3e57912f00b8c246d4b7654e7cde4b77408a5fc868eb1e52e +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00036.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00036.bin new file mode 100644 index 0000000000000000000000000000000000000000..5f15679700fec48157137db80f8134c80d3c56a1 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00036.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:0d2e2c6008d5e0845937200ef339063e112f493c1d8b48a74feec08061e46560 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00037.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00037.bin new file mode 100644 index 0000000000000000000000000000000000000000..fac4a5a593fc8c80e931aacd0297ce6ce2cb239e --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00037.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:212cd04a4207e70cb999d92ac1682fef04a0da2d03954b07de7f0451c27dbcc2 +size 67108864 diff --git a/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00038.bin b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00038.bin new file mode 100644 index 0000000000000000000000000000000000000000..e8393a55f0c9daa28916ee8e3b967cce77c62672 --- /dev/null +++ b/qwen35-2b-fp32-int8-g32-home-token-major-v2/weights/00038.bin @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:4d3e63880b48456dcf9e9cae7a12838af3d04ad01c6ef352a7ad77d9e01c9d63 +size 13483392 diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-16.json b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-16.json new file mode 100644 index 0000000000000000000000000000000000000000..1b10f9383c553c562fe894fd9e8024dcebad1ce6 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-16.json @@ -0,0 +1,80235 @@ +{ + "inputs": [ + "input_ids", + "position_ids", + "attention_mask", + "image_embedding", + "is_image", + "cache_position", + "states_0", + "states_1", + "states_2", + "states_3", + "states_4", + "states_5", + "states_6", + "states_7", + "states_8", + "states_9", + "states_10", + "states_11", + "states_12", + "states_13", + "states_14", + "states_15", + "states_16", + "states_17", + "states_18", + "states_19", + "states_20", + "states_21", + "states_22", + "states_23", + "states_24", + "states_25", + "states_26", + "states_27", + "states_28", + "states_29", + "states_30", + "states_31", + "states_32", + "states_33", + "states_34", + "states_35", + "states_36", + "states_37", + "states_38", + "states_39", + "states_40", + "states_41", + "states_42", + "states_43", + "states_44", + "states_45", + "states_46", + "states_47" + ], + "outputs": [ + "linear_186", + "slice_10", + "slice_16", + "slice_18", + "slice_24", + "slice_26", + "slice_32", + "cache_update", + "cache_update_1", + "slice_44", + "slice_50", + "slice_52", + "slice_58", + "slice_60", + "slice_66", + "cache_update_2", + "cache_update_3", + "slice_78", + "slice_84", + "slice_86", + "slice_92", + "slice_94", + "slice_100", + "cache_update_4", + "cache_update_5", + "slice_112", + "slice_118", + "slice_120", + "slice_126", + "slice_128", + "slice_134", + "cache_update_6", + "cache_update_7", + "slice_146", + "slice_152", + "slice_154", + "slice_160", + "slice_162", + "slice_168", + "cache_update_8", + "cache_update_9", + "slice_180", + "slice_186", + "slice_188", + "slice_194", + "slice_196", + "slice_202", + "cache_update_10", + "cache_update_11" + ], + "tensors": { + "p_model_model_language_model_embed_tokens_weight": { + "shape": [ + 248320, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1017118720, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00000.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00001.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00002.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00003.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00004.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00005.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00006.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00007.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00008.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00009.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00010.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00011.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00012.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00013.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00014.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00015.bin", + "offset": 0, + "byteLength": 10485760 + } + ] + }, + "p_model_model_language_model_layers_0_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10485760, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10493952, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10494016, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10494080, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 35659904, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44048512, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44114048, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44179584, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44277888, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44278400, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_0_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 52667008, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 52675200, + "byteLength": 14433664 + }, + { + "path": "weights/00016.bin", + "offset": 0, + "byteLength": 10732160 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 10732160, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 35897984, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_1_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61063808, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072000, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072064, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072128, + "byteLength": 6036736 + }, + { + "path": "weights/00017.bin", + "offset": 0, + "byteLength": 19129088 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 19129088, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27517696, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27583232, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27648768, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27747072, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27747584, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_1_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 36136192, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 36144384, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 61310208, + "byteLength": 5798656 + }, + { + "path": "weights/00018.bin", + "offset": 0, + "byteLength": 19367168 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00018.bin", + "offset": 19367168, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_2_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44532992, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541184, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541248, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541312, + "byteLength": 22567552 + }, + { + "path": "weights/00019.bin", + "offset": 0, + "byteLength": 2598272 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 2598272, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 10986880, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11052416, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11117952, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11216256, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11216768, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_2_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 19605376, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 19613568, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 44779392, + "byteLength": 22329472 + }, + { + "path": "weights/00020.bin", + "offset": 0, + "byteLength": 2836352 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 2836352, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_3_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 28002176, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 28010368, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 44787584, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 44788608, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 46885760, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 46886784, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 48983936, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_3_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 57372544, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 57380736, + "byteLength": 9728128 + }, + { + "path": "weights/00021.bin", + "offset": 0, + "byteLength": 15437696 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 15437696, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 40603520, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_4_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65769344, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777536, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777600, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777664, + "byteLength": 1331200 + }, + { + "path": "weights/00022.bin", + "offset": 0, + "byteLength": 23834624 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 23834624, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32223232, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32288768, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32354304, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32452608, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32453120, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_4_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 40841728, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 40849920, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 66015744, + "byteLength": 1093120 + }, + { + "path": "weights/00023.bin", + "offset": 0, + "byteLength": 24072704 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00023.bin", + "offset": 24072704, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_5_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49238528, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246720, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246784, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246848, + "byteLength": 17862016 + }, + { + "path": "weights/00024.bin", + "offset": 0, + "byteLength": 7303808 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 7303808, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15692416, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15757952, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15823488, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15921792, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15922304, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_5_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 24310912, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 24319104, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 49484928, + "byteLength": 17623936 + }, + { + "path": "weights/00025.bin", + "offset": 0, + "byteLength": 7541888 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 7541888, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32707712, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32715904, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32715968, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32716032, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 57881856, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66270464, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66336000, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66401536, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66499840, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66500352, + "byteLength": 608512 + }, + { + "path": "weights/00026.bin", + "offset": 0, + "byteLength": 7780096 + } + ] + }, + "p_model_model_language_model_layers_6_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00026.bin", + "offset": 7780096, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 7788288, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 32954112, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 58119936, + "byteLength": 8988928 + }, + { + "path": "weights/00027.bin", + "offset": 0, + "byteLength": 16176896 + } + ] + }, + "p_model_model_language_model_layers_7_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 16176896, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 16185088, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 32962304, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 32963328, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 35060480, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 35061504, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 37158656, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_7_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 45547264, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 45555456, + "byteLength": 21553408 + }, + { + "path": "weights/00028.bin", + "offset": 0, + "byteLength": 3612416 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 3612416, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 28778240, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_8_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53944064, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952256, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952320, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952384, + "byteLength": 13156480 + }, + { + "path": "weights/00029.bin", + "offset": 0, + "byteLength": 12009344 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 12009344, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20397952, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20463488, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20529024, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20627328, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20627840, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_8_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 29016448, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 29024640, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 54190464, + "byteLength": 12918400 + }, + { + "path": "weights/00030.bin", + "offset": 0, + "byteLength": 12247424 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 12247424, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37413248, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421440, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421504, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421568, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 62587392, + "byteLength": 4521472 + }, + { + "path": "weights/00031.bin", + "offset": 0, + "byteLength": 3867136 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3867136, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3932672, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3998208, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 4096512, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 4097024, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_9_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 12485632, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 12493824, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 37659648, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 62825472, + "byteLength": 4283392 + }, + { + "path": "weights/00032.bin", + "offset": 0, + "byteLength": 20882432 + } + ] + }, + "p_model_model_language_model_layers_10_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20882432, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890624, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890688, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890752, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 46056576, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54445184, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54510720, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54576256, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54674560, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54675072, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_10_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 63063680, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 63071872, + "byteLength": 4036992 + }, + { + "path": "weights/00033.bin", + "offset": 0, + "byteLength": 21128832 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00033.bin", + "offset": 21128832, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00033.bin", + "offset": 46294656, + "byteLength": 20814208 + }, + { + "path": "weights/00034.bin", + "offset": 0, + "byteLength": 4351616 + } + ] + }, + "p_model_model_language_model_layers_11_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 4351616, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 4359808, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 21137024, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 21138048, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 23235200, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 23236224, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 25333376, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_11_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 33721984, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 33730176, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 58896000, + "byteLength": 8212864 + }, + { + "path": "weights/00035.bin", + "offset": 0, + "byteLength": 16952960 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00035.bin", + "offset": 16952960, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_12_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42118784, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42126976, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42127040, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42127104, + "byteLength": 24981760 + }, + { + "path": "weights/00036.bin", + "offset": 0, + "byteLength": 184064 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 184064, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8572672, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8638208, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8703744, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8802048, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8802560, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_12_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 17191168, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 17199360, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 42365184, + "byteLength": 24743680 + }, + { + "path": "weights/00037.bin", + "offset": 0, + "byteLength": 422144 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 422144, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25587968, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596160, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596224, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596288, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 50762112, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59150720, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59216256, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59281792, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59380096, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59380608, + "byteLength": 7728256 + }, + { + "path": "weights/00038.bin", + "offset": 0, + "byteLength": 660352 + } + ] + }, + "p_model_model_language_model_layers_13_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00038.bin", + "offset": 660352, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 668544, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 25834368, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 51000192, + "byteLength": 16108672 + }, + { + "path": "weights/00039.bin", + "offset": 0, + "byteLength": 9057152 + } + ] + }, + "p_model_model_language_model_layers_14_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9057152, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065344, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065408, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065472, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 34231296, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42619904, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42685440, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42750976, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42849280, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42849792, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_14_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 51238400, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 51246592, + "byteLength": 15862272 + }, + { + "path": "weights/00040.bin", + "offset": 0, + "byteLength": 9303552 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 9303552, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 34469376, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_15_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00040.bin", + "offset": 59635200, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 59643392, + "byteLength": 7465472 + }, + { + "path": "weights/00041.bin", + "offset": 0, + "byteLength": 9311744 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 9311744, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 9312768, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 11409920, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 11410944, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 13508096, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_15_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 21896704, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 21904896, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 47070720, + "byteLength": 20038144 + }, + { + "path": "weights/00042.bin", + "offset": 0, + "byteLength": 5127680 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 5127680, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30293504, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301696, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301760, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301824, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 55467648, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63856256, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63921792, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63987328, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 64085632, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 64086144, + "byteLength": 3022720 + }, + { + "path": "weights/00043.bin", + "offset": 0, + "byteLength": 5365888 + } + ] + }, + "p_model_model_language_model_layers_16_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00043.bin", + "offset": 5365888, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 5374080, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 30539904, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 55705728, + "byteLength": 11403136 + }, + { + "path": "weights/00044.bin", + "offset": 0, + "byteLength": 13762688 + } + ] + }, + "p_model_model_language_model_layers_17_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13762688, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13770880, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13770944, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13771008, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 38936832, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47325440, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47390976, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47456512, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47554816, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47555328, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_17_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 55943936, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 55952128, + "byteLength": 11156736 + }, + { + "path": "weights/00045.bin", + "offset": 0, + "byteLength": 14009088 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 14009088, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 39174912, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_18_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64340736, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64348928, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64348992, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64349056, + "byteLength": 2759808 + }, + { + "path": "weights/00046.bin", + "offset": 0, + "byteLength": 22406016 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 22406016, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30794624, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30860160, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30925696, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 31024000, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 31024512, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_18_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 39413120, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 39421312, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 64587136, + "byteLength": 2521728 + }, + { + "path": "weights/00047.bin", + "offset": 0, + "byteLength": 22644096 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 22644096, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 47809920, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 47818112, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 64595328, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 64596352, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 66693504, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 66694528, + "byteLength": 414336 + }, + { + "path": "weights/00048.bin", + "offset": 0, + "byteLength": 1682816 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 1682816, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_19_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00048.bin", + "offset": 10071424, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 10079616, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 35245440, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 60411264, + "byteLength": 6697600 + }, + { + "path": "weights/00049.bin", + "offset": 0, + "byteLength": 18468224 + } + ] + }, + "p_model_model_language_model_layers_20_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18468224, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476416, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476480, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476544, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 43642368, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52030976, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52096512, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52162048, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52260352, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52260864, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_20_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 60649472, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 60657664, + "byteLength": 6451200 + }, + { + "path": "weights/00050.bin", + "offset": 0, + "byteLength": 18714624 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00050.bin", + "offset": 18714624, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00050.bin", + "offset": 43880448, + "byteLength": 23228416 + }, + { + "path": "weights/00051.bin", + "offset": 0, + "byteLength": 1937408 + } + ] + }, + "p_model_model_language_model_layers_21_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1937408, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945600, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945664, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945728, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 27111552, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35500160, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35565696, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35631232, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35729536, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35730048, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_21_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 44118656, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 44126848, + "byteLength": 22982016 + }, + { + "path": "weights/00052.bin", + "offset": 0, + "byteLength": 2183808 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 2183808, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 27349632, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_22_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52515456, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523648, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523712, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523776, + "byteLength": 14585088 + }, + { + "path": "weights/00053.bin", + "offset": 0, + "byteLength": 10580736 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 10580736, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 18969344, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19034880, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19100416, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19198720, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19199232, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_22_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 27587840, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 27596032, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 52761856, + "byteLength": 14347008 + }, + { + "path": "weights/00054.bin", + "offset": 0, + "byteLength": 10818816 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 10818816, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_23_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 35984640, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 35992832, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 52770048, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 52771072, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 54868224, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 54869248, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 56966400, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_23_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 65355008, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 65363200, + "byteLength": 1745664 + }, + { + "path": "weights/00055.bin", + "offset": 0, + "byteLength": 23420160 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00055.bin", + "offset": 23420160, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00055.bin", + "offset": 48585984, + "byteLength": 18522880 + }, + { + "path": "weights/00056.bin", + "offset": 0, + "byteLength": 6642944 + } + ] + }, + "p_model_model_language_model_norm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00056.bin", + "offset": 6642944, + "byteLength": 8192 + } + ] + }, + "b_model_model_language_model_rotary_emb_inv_freq": { + "shape": [ + 32 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 128, + "parts": [ + { + "path": "weights/00056.bin", + "offset": 6651136, + "byteLength": 128 + } + ] + }, + "input_ids": { + "shape": [ + 1, + 16 + ], + "dtype": "int32", + "role": "input", + "byteLength": 64, + "indexBounds": [ + 0, + 248320 + ] + }, + "position_ids": { + "shape": [ + 4, + 1, + 16 + ], + "dtype": "int32", + "role": "input", + "byteLength": 256 + }, + "attention_mask": { + "shape": [ + 1, + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "input", + "byteLength": 262144 + }, + "image_embedding": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "input", + "byteLength": 131072 + }, + "is_image": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "bool", + "role": "input", + "byteLength": 64 + }, + "cache_position": { + "shape": [ + 1, + 16 + ], + "dtype": "int32", + "role": "input", + "byteLength": 64, + "indexBounds": [ + 0, + 4096 + ] + }, + "states_0": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_1": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_2": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_3": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_4": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_5": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_6": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_7": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_8": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_9": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_10": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_11": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_12": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_13": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_14": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_15": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_16": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_17": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_18": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_19": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_20": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_21": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_22": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_23": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_24": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_25": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_26": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_27": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_28": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_29": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_30": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_31": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_32": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_33": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_34": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_35": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_36": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_37": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_38": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_39": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_40": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_41": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_42": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_43": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_45": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_46": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_47": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "embedding": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "where": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_1": { + "shape": [ + 3, + 1, + 16 + ], + "dtype": "int32", + "role": "value", + "byteLength": 192 + }, + "unsqueeze": { + "shape": [ + 1, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "unsqueeze_1": { + "shape": [ + 1, + 1, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "unsqueeze_2": { + "shape": [ + 1, + 1, + 32, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "expand": { + "shape": [ + 3, + 1, + 32, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 384 + }, + "unsqueeze_3": { + "shape": [ + 3, + 1, + 1, + 16 + ], + "dtype": "int32", + "role": "value", + "byteLength": 192 + }, + "_to_copy": { + "shape": [ + 3, + 1, + 1, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 192 + }, + "matmul": { + "shape": [ + 3, + 1, + 32, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "transpose": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "select": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "select_1": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_2": { + "shape": [ + 1, + 16, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 704 + }, + "slice_3": { + "shape": [ + 1, + 16, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 704 + }, + "copy": { + "shape": [ + 1, + 16, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 704 + }, + "transpose_1": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "select_2": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_scatter": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "select_scatter": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "transpose_2": { + "shape": [ + 3, + 1, + 32, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "transpose_7": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "select_7": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_7": { + "shape": [ + 1, + 16, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 640 + }, + "transpose_8": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "select_8": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_8": { + "shape": [ + 1, + 16, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 640 + }, + "copy_1": { + "shape": [ + 1, + 16, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 640 + }, + "transpose_9": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "select_9": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_scatter_1": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "select_scatter_1": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "transpose_10": { + "shape": [ + 3, + 1, + 32, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "transpose_12": { + "shape": [ + 3, + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "select_11": { + "shape": [ + 1, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat": { + "shape": [ + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cos": { + "shape": [ + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul": { + "shape": [ + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "sin": { + "shape": [ + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_1": { + "shape": [ + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "pow_1": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_2": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_1": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_13": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_1": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_2": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_3": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_1": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_10": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_4": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_11": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_12": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_14": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_13": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_14": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_15": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_1": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_2": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_3": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_2": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_4": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_5": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_1": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_3": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_1": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_6": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_7": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_2": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_4": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_2": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_8": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_16": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_17": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_15": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_4": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_5": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_2": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_1": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_5": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_3": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_9": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_10": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_1": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_11": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_6": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_4": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_6": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_2": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_7": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_4": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_12": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_8": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_13": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_1": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_5": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_2": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_6": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_14": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_7": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_9": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_4": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_3": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_10": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_5": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_15": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_11": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_16": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_2": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_8": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_16": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_9": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_7": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_10": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_11": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_2": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_18": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_1": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_5": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_1": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_19": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_3": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_20": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_17": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_21": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_22": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_23": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_8": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_9": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_10": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_1": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_1": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_1": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_12": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_1": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_17": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_18": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_3": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_13": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_6": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_19": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_20": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_4": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_14": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_7": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_21": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_1": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_24": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_25": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_18": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_1": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_11": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_12": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_5": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_4": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_15": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_8": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_22": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_23": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_4": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_24": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_13": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_12": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_16": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_6": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_5": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_17": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_9": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_25": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_18": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_26": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_13": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_5": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_14": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_27": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_15": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_19": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_7": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_6": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_20": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_10": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_28": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_21": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_29": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_4": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_16": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_19": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_17": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_14": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_18": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_19": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_3": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_26": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_2": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_6": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_2": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_27": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_6": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_28": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_20": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_29": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_30": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_31": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_15": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_16": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_17": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_2": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_2": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_2": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_22": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_2": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_30": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_31": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_5": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_23": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_11": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_32": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_33": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_6": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_24": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_12": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_34": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_2": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_32": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_33": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_21": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_2": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_18": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_19": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_8": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_7": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_25": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_13": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_35": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_36": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_7": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_37": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_20": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_20": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_26": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_9": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_8": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_27": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_14": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_38": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_28": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_39": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_5": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_21": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_8": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_22": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_40": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_23": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_29": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_10": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_9": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_30": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_15": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_41": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_31": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_42": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_6": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_24": { + "shape": [ + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "view_21": { + "shape": [ + 1, + 16, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "slice_34": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_35": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_3": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "_unsafe_view": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_22": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_11": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_10": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_32": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_16": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_43": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_33": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_44": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_7": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_22": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_25": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_23": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_12": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_11": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_34": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_17": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_45": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_35": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_46": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_8": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_23": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_26": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_24": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_24": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "unsqueeze_7": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "unsqueeze_8": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_36": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_37": { + "shape": [ + 1, + 8, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_38": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_39": { + "shape": [ + 1, + 2, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "mul_47": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_40": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_41": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_3": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_4": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_48": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_36": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_49": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_42": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_43": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_4": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_5": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_50": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_37": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat_6": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cat_7": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cache_update": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_1": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_9": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_1": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_4": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_1": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_10": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_2": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_5": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_2": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_25": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_1": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "mul_51": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "add_38": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "softmax": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "matmul_2": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_26": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_6": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_25": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_52": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_27": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_39": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_13": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_12": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_40": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_18": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_53": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_41": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_54": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_9": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_28": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_9": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_29": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_55": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_30": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_42": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_14": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_13": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_43": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_19": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_56": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_44": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_57": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_10": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_31": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_27": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_32": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_26": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_33": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_34": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_8": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_3": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_11": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_3": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_45": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_10": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_46": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_28": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_47": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_48": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_49": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_27": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_28": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_29": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_4": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_3": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_5": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_45": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_3": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_58": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_59": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_7": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_46": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_20": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_60": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_61": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_8": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_47": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_21": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_62": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_3": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_50": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_51": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_29": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_7": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_30": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_31": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_15": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_14": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_48": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_22": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_63": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_64": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_11": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_65": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_32": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_35": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_49": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_16": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_15": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_50": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_23": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_66": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_51": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_67": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_11": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_36": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_12": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_37": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_68": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_38": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_52": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_17": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_16": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_53": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_24": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_69": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_54": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_70": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_12": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_39": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_30": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_40": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_33": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_41": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_42": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_9": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_52": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_4": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_12": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_4": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_53": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_13": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_54": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_31": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_55": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_56": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_57": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_34": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_35": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_36": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_5": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_4": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_6": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_55": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_4": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_71": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_72": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_9": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_56": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_25": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_73": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_74": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_10": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_57": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_26": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_75": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_4": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_58": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_59": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_32": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_8": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_37": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_38": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_18": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_17": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_58": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_27": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_76": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_77": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_14": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_78": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_39": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_43": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_59": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_19": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_18": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_60": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_28": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_79": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_61": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_80": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_13": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_44": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_15": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_45": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_81": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_46": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_62": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_20": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_19": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_63": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_29": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_82": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_64": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_83": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_14": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_47": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_33": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_48": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_40": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_49": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_50": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_10": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_60": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_5": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_13": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_5": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_61": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_16": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_62": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_34": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_63": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_64": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_65": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_41": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_42": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_43": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_6": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_5": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_7": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_65": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_5": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_84": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_85": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_11": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_66": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_30": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_86": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_87": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_12": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_67": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_31": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_88": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_5": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_66": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_67": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_35": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_9": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_44": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_45": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_21": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_20": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_68": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_32": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_89": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_90": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_17": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_91": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_46": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_51": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_69": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_22": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_21": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_70": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_33": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_92": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_71": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_93": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_15": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_52": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_18": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_53": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_94": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_54": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_72": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_23": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_22": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_73": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_34": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_95": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_74": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_96": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_16": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_55": { + "shape": [ + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "view_47": { + "shape": [ + 1, + 16, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "slice_68": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_69": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_10": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "_unsafe_view_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_48": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_24": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_23": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_75": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_35": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_97": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_76": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_98": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_17": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_36": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_56": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_49": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_25": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_24": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_77": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_36": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_99": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_78": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_100": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_18": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_37": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_57": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_50": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_38": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "unsqueeze_14": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "unsqueeze_15": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_70": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_71": { + "shape": [ + 1, + 8, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_72": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_73": { + "shape": [ + 1, + 2, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "mul_101": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_74": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_75": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_8": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_11": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_102": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_79": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_103": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_76": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_77": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_9": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_12": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_104": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_80": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat_13": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cat_14": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cache_update_2": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_3": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_16": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_3": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_11": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_4": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_17": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_4": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_12": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_5": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_39": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_3": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "mul_105": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "add_81": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "softmax_1": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "matmul_4": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_40": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_13": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_51": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_7": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_106": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_58": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_82": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_26": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_25": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_83": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_37": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_107": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_84": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_108": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_19": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_59": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_19": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_60": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_109": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_61": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_85": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_27": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_26": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_86": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_38": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_110": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_87": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_111": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_20": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_62": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_41": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_63": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_52": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_64": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_65": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_15": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_78": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_6": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_18": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_6": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_79": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_20": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_80": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_42": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_81": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_82": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_83": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_53": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_54": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_55": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_8": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_6": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_10": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_88": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_6": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_112": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_113": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_13": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_89": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_39": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_114": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_115": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_14": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_90": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_40": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_116": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_6": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_84": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_85": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_43": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_14": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_56": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_57": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_28": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_27": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_91": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_41": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_117": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_118": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_21": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_119": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_58": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_66": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_92": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_29": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_28": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_93": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_42": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_120": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_94": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_121": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_21": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_67": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_22": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_68": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_122": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_69": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_95": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_30": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_29": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_96": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_43": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_123": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_97": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_124": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_22": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_70": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_44": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_71": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_59": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_72": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_73": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_16": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_86": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_7": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_19": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_7": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_87": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_23": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_88": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_45": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_89": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_90": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_91": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_60": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_61": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_62": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_9": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_7": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_11": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_98": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_7": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_125": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_126": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_15": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_99": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_44": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_127": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_128": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_16": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_100": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_45": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_129": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_7": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_92": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_93": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_46": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_15": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_63": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_64": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_31": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_30": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_101": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_46": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_130": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_131": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_24": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_132": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_65": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_74": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_102": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_32": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_31": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_103": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_47": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_133": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_104": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_134": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_23": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_75": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_25": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_76": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_135": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_77": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_105": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_33": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_32": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_106": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_48": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_136": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_107": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_137": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_24": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_78": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_47": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_79": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_66": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_80": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_81": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_17": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_94": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_8": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_20": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_8": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_95": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_26": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_96": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_48": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_97": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_98": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_99": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_67": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_68": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_69": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_10": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_8": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_12": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_108": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_8": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_138": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_139": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_17": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_109": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_49": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_140": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_141": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_18": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_110": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_50": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_142": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_8": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_100": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_101": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_49": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_16": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_70": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_71": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_34": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_33": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_111": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_51": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_143": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_144": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_27": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_145": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_72": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_82": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_112": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_35": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_34": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_113": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_52": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_146": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_114": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_147": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_25": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_83": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_28": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_84": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_148": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_85": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_115": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_36": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_35": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_116": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_53": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_149": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_117": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_150": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_26": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_86": { + "shape": [ + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "view_73": { + "shape": [ + 1, + 16, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "slice_102": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_103": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_17": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "_unsafe_view_6": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_74": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_37": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_36": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_118": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_54": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_151": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_119": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_152": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_27": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_50": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_87": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_75": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_38": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_37": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_120": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_55": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_153": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_121": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_154": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_28": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_51": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_88": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_76": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_52": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "unsqueeze_21": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "unsqueeze_22": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_104": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_105": { + "shape": [ + 1, + 8, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_106": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_107": { + "shape": [ + 1, + 2, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "mul_155": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_108": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_109": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_13": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_18": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_156": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_122": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_157": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_110": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_111": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_14": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_19": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_158": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_123": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat_20": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cat_21": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cache_update_4": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_5": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_23": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_5": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_18": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_7": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_24": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_6": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_19": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_8": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_53": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_5": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "mul_159": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "add_124": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "softmax_2": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "matmul_6": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_54": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_20": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_77": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_11": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_160": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_89": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_125": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_39": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_38": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_126": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_56": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_161": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_127": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_162": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_29": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_90": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_29": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_91": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_163": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_92": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_128": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_40": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_39": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_129": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_57": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_164": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_130": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_165": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_30": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_93": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_55": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_94": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_78": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_95": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_96": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_22": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_112": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_9": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_25": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_9": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_113": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_30": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_114": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_56": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_115": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_116": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_117": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_79": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_80": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_81": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_12": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_9": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_15": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_131": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_9": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_166": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_167": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_19": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_132": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_58": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_168": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_169": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_20": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_133": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_59": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_170": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_9": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_118": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_119": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_57": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_21": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_82": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_83": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_41": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_40": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_134": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_60": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_171": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_172": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_31": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_173": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_84": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_97": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_135": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_42": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_41": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_136": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_61": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_174": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_137": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_175": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_31": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_98": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_32": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_99": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_176": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_100": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_138": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_43": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_42": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_139": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_62": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_177": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_140": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_178": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_32": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_101": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_58": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_102": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_85": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_103": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_104": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_23": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_120": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_10": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_26": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_10": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_121": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_33": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_122": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_59": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_123": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_124": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_125": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_86": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_87": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_88": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_13": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_10": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_16": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_141": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_10": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_179": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_180": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_21": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_142": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_63": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_181": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_182": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_22": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_143": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_64": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_183": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_10": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_126": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_127": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_60": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_22": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_89": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_90": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_44": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_43": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_144": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_65": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_184": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_185": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_34": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_186": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_91": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_105": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_145": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_45": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_44": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_146": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_66": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_187": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_147": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_188": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_33": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_106": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_35": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_107": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_189": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_108": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_148": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_46": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_45": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_149": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_67": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_190": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_150": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_191": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_34": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_109": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_61": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_110": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_92": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_111": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_112": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_24": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_128": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_11": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_27": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_11": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_129": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_36": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_130": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_62": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_131": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_132": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_133": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_93": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_94": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_95": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_14": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_11": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_17": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_151": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_11": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_192": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_193": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_23": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_152": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_68": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_194": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_195": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_24": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_153": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_69": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_196": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_11": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_134": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_135": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_63": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_23": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_96": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_97": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_47": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_46": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_154": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_70": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_197": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_198": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_37": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_199": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_98": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_113": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_155": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_48": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_47": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_156": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_71": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_200": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_157": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_201": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_35": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_114": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_38": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_115": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_202": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_116": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_158": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_49": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_48": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_159": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_72": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_203": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_160": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_204": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_36": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_117": { + "shape": [ + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "view_99": { + "shape": [ + 1, + 16, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "slice_136": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_137": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_24": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "_unsafe_view_9": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_100": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_50": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_49": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_161": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_73": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_205": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_162": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_206": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_37": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_64": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_118": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_101": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_51": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_50": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_163": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_74": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_207": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_164": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_208": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_38": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_65": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_119": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_102": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_66": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "unsqueeze_28": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "unsqueeze_29": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_138": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_139": { + "shape": [ + 1, + 8, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_140": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_141": { + "shape": [ + 1, + 2, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "mul_209": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_142": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_143": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_18": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_25": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_210": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_165": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_211": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_144": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_145": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_19": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_26": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_212": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_166": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat_27": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cat_28": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cache_update_6": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_7": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_30": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_7": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_25": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_10": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_31": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_8": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_26": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_11": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_67": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_7": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "mul_213": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "add_167": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "softmax_3": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "matmul_8": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_68": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_27": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_103": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_15": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_214": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_120": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_168": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_52": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_51": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_169": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_75": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_215": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_170": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_216": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_39": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_121": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_39": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_122": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_217": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_123": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_171": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_53": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_52": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_172": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_76": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_218": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_173": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_219": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_40": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_124": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_69": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_125": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_104": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_126": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_127": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_29": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_146": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_12": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_32": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_12": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_147": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_40": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_148": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_70": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_149": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_150": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_151": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_105": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_106": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_107": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_16": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_12": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_20": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_174": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_12": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_220": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_221": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_25": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_175": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_77": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_222": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_223": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_26": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_176": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_78": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_224": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_12": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_152": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_153": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_71": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_28": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_108": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_109": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_54": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_53": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_177": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_79": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_225": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_226": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_41": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_227": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_110": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_128": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_178": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_55": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_54": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_179": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_80": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_228": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_180": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_229": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_41": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_129": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_42": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_130": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_230": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_131": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_181": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_56": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_55": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_182": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_81": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_231": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_183": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_232": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_42": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_132": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_72": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_133": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_111": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_134": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_135": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_30": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_154": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_13": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_33": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_13": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_155": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_43": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_156": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_73": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_157": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_158": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_159": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_112": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_113": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_114": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_17": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_13": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_21": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_184": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_13": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_233": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_234": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_27": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_185": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_82": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_235": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_236": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_28": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_186": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_83": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_237": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_13": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_160": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_161": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_74": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_29": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_115": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_116": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_57": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_56": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_187": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_84": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_238": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_239": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_44": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_240": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_117": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_136": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_188": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_58": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_57": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_189": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_85": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_241": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_190": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_242": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_43": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_137": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_45": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_138": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_243": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_139": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_191": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_59": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_58": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_192": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_86": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_244": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_193": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_245": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_44": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_140": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_75": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_141": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_118": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_142": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_143": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_31": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_162": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_14": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_34": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_14": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_163": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_46": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_164": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_76": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_165": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_166": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_167": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_119": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_120": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_121": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_18": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_14": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_22": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_194": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_14": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_246": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_247": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_29": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_195": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_87": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_248": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_249": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_30": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_196": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_88": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_250": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_14": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_168": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_169": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_77": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_30": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_122": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_123": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_60": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_59": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_197": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_89": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_251": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_252": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_47": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_253": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_124": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_144": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_198": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_61": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_60": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_199": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_90": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_254": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_200": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_255": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_45": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_145": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_48": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_146": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_256": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_147": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_201": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_62": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_61": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_202": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_91": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_257": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_203": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_258": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_46": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_148": { + "shape": [ + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "view_125": { + "shape": [ + 1, + 16, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "slice_170": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_171": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_31": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "_unsafe_view_12": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_126": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_63": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_62": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_204": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_92": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_259": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_205": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_260": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_47": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_78": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_149": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_127": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_64": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_63": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_206": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_93": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_261": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_207": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_262": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_48": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_79": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_150": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_128": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_80": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "unsqueeze_35": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "unsqueeze_36": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_172": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_173": { + "shape": [ + 1, + 8, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_174": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_175": { + "shape": [ + 1, + 2, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "mul_263": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_176": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_177": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_23": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_32": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_264": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_208": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_265": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_178": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_179": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_24": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_33": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_266": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_209": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat_34": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cat_35": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cache_update_8": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_9": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_37": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_9": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_32": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_13": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_38": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_10": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_33": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_14": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_81": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_9": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "mul_267": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "add_210": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "softmax_4": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "matmul_10": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_82": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_34": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_129": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_19": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_268": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_151": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_211": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_65": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_64": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_212": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_94": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_269": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_213": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_270": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_49": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_152": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_49": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_153": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_271": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_154": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_214": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_66": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_65": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_215": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_95": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_272": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_216": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_273": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_50": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_155": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_83": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_156": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_130": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_157": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_158": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_36": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_180": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_15": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_39": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_15": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_181": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_50": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_182": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_84": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_183": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_184": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_185": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_131": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_132": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_133": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_20": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_15": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_25": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_217": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_15": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_274": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_275": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_31": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_218": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_96": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_276": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_277": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_32": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_219": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_97": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_278": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_15": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_186": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_187": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_85": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_35": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_134": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_135": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_67": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_66": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_220": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_98": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_279": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_280": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_51": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_281": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_136": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_159": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_221": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_68": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_67": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_222": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_99": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_282": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_223": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_283": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_51": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_160": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_52": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_161": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_284": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_162": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_224": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_69": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_68": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_225": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_100": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_285": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_226": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_286": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_52": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_163": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_86": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_164": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_137": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_165": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_166": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_37": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_188": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_16": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_40": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_16": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_189": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_53": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_190": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_87": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_191": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_192": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_193": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_138": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_139": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_140": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_21": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_16": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_26": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_227": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_16": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_287": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_288": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_33": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_228": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_101": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_289": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_290": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_34": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_229": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_102": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_291": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_16": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_194": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_195": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_88": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_36": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_141": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_142": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_70": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_69": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_230": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_103": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_292": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_293": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_54": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_294": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_143": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_167": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_231": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_71": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_70": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_232": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_104": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_295": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_233": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_296": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_53": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_168": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_55": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_169": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_297": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_170": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_234": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_72": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_71": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_235": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_105": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_298": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_236": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_299": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_54": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_171": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_89": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_172": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_144": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_173": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "linear_174": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_38": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_196": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_17": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_41": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_17": { + "shape": [ + 1, + 6144, + 23 + ], + "dtype": "float32", + "role": "value", + "byteLength": 565248 + }, + "slice_197": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "silu_56": { + "shape": [ + 1, + 6144, + 20 + ], + "dtype": "float32", + "role": "value", + "byteLength": 491520 + }, + "slice_198": { + "shape": [ + 1, + 6144, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "transpose_90": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_199": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_200": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_201": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_145": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_146": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_147": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_22": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "exp_17": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_27": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_237": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "softplus_17": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_300": { + "shape": [ + 1, + 16, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_301": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_35": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_238": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_106": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_302": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_303": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sum_36": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_239": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_107": { + "shape": [ + 1, + 16, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_304": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "normalized_gated_delta_rule_17": { + "shape": [ + 1, + 16, + 144, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1179648 + }, + "slice_202": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_203": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_91": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_37": { + "shape": [ + 1, + 16, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_148": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_149": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_73": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_72": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "add_240": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "rsqrt_108": { + "shape": [ + 256, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_305": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_306": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "silu_57": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_307": { + "shape": [ + 256, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_150": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_175": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_241": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_74": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_73": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_242": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_109": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_308": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_243": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_309": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_55": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_176": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_58": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_177": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_310": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_178": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_244": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_75": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_74": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_245": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_110": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_311": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_246": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_312": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_56": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_179": { + "shape": [ + 1, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "view_151": { + "shape": [ + 1, + 16, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 262144 + }, + "slice_204": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_205": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_38": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "_unsafe_view_15": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_152": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_76": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_75": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_247": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_111": { + "shape": [ + 1, + 16, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_313": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_248": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_314": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_57": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_92": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_180": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_153": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_77": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_76": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_249": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_112": { + "shape": [ + 1, + 16, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_315": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_250": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_316": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_58": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_93": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_181": { + "shape": [ + 1, + 16, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_154": { + "shape": [ + 1, + 16, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_94": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "unsqueeze_42": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "unsqueeze_43": { + "shape": [ + 1, + 1, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_206": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_207": { + "shape": [ + 1, + 8, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_208": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_209": { + "shape": [ + 1, + 2, + 16, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "mul_317": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_210": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_211": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_28": { + "shape": [ + 1, + 8, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_39": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_318": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_251": { + "shape": [ + 1, + 8, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_319": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_212": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_213": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_29": { + "shape": [ + 1, + 2, + 16, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_40": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_320": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_252": { + "shape": [ + 1, + 2, + 16, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat_41": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cat_42": { + "shape": [ + 1, + 2, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cache_update_10": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_11": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_44": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_11": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_39": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_16": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_45": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_12": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_40": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_17": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_95": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_11": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "mul_321": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "add_253": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "softmax_5": { + "shape": [ + 1, + 8, + 16, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "matmul_12": { + "shape": [ + 1, + 8, + 16, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_96": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "clone_41": { + "shape": [ + 1, + 16, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_155": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "sigmoid_23": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_322": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_182": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_254": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_78": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_77": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_255": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_113": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_323": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_256": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_324": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_59": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_183": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "silu_59": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_184": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "mul_325": { + "shape": [ + 1, + 16, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "linear_185": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_257": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_79": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_78": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_258": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "rsqrt_114": { + "shape": [ + 1, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "mul_326": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_259": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_327": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_60": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "alias": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_186": { + "shape": [ + 1, + 16, + 248320 + ], + "dtype": "float32", + "role": "value", + "byteLength": 15892480 + }, + "p_model_model_language_model_embed_tokens_weight__rows_0_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 0 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00000.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00001.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_0": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 134217728 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00002.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00003.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_1": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 268435456 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00004.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00005.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_2": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 402653184 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00006.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00007.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 536870912 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00008.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00009.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_4": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 671088640 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00010.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00011.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_5": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 805306368 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00012.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00013.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_6": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944": { + "shape": [ + 18944, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 77594624, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 939524096 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00014.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00015.bin", + "offset": 0, + "byteLength": 10485760 + } + ] + }, + "embedding__part_7": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "embedding__sum_0": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "embedding__sum_1": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "embedding__sum_2": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "embedding__sum_3": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "embedding__sum_4": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "embedding__sum_5": { + "shape": [ + 1, + 16, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_186__part_0": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_1": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_2": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_3": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_4": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_5": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_6": { + "shape": [ + 1, + 16, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2097152 + }, + "linear_186__part_7": { + "shape": [ + 1, + 16, + 18944 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1212416 + }, + "linear_186__cat_0_0": { + "shape": [ + 1, + 16, + 229376 + ], + "dtype": "float32", + "role": "value", + "byteLength": 14680064 + }, + "linear_186__cat_0_7": { + "shape": [ + 1, + 16, + 18944 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1212416 + } + }, + "nodes": [ + { + "id": "embedding", + "op": "aten.embedding.default", + "args": [ + { + "tensor": "p_model_model_language_model_embed_tokens_weight" + }, + { + "tensor": "input_ids" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 146, in forward\n text_embedding = self.model.get_input_embeddings()(input_ids)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "where", + "op": "aten.where.self", + "args": [ + { + "tensor": "is_image" + }, + { + "tensor": "image_embedding" + }, + { + "tensor": "embedding" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 147, in forward\n embedding = torch.where(is_image, image_embedding, text_embedding)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_1", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "position_ids" + }, + 0, + 1, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1183, in forward\n position_ids = position_ids[1:]\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "b_model_model_language_model_rotary_emb_inv_freq" + }, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 5, in forward\n unsqueeze = torch.ops.aten.unsqueeze.default(b_model_model_language_model_rotary_emb_inv_freq, 0); b_model_model_language_model_rotary_emb_inv_freq = None" + }, + { + "id": "unsqueeze_1", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "unsqueeze" + }, + 1 + ], + "kwargs": {}, + "source": "File \".49\", line 6, in forward\n unsqueeze_1 = torch.ops.aten.unsqueeze.default(unsqueeze, 1); unsqueeze = None" + }, + { + "id": "unsqueeze_2", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "unsqueeze_1" + }, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 7, in forward\n unsqueeze_2 = torch.ops.aten.unsqueeze.default(unsqueeze_1, 3); unsqueeze_1 = None" + }, + { + "id": "expand", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_2" + }, + [ + 3, + 1, + -1, + 1 + ] + ], + "kwargs": {}, + "source": "File \".49\", line 10, in forward\n expand = torch.ops.aten.expand.default(to, [3, 1, -1, 1]); to = None" + }, + { + "id": "unsqueeze_3", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "slice_1" + }, + 2 + ], + "kwargs": {}, + "source": "File \".49\", line 13, in forward\n unsqueeze_3 = torch.ops.aten.unsqueeze.default(slice_1, 2); slice_1 = None" + }, + { + "id": "_to_copy", + "op": "aten._to_copy.default", + "args": [ + { + "tensor": "unsqueeze_3" + } + ], + "kwargs": { + "dtype": { + "dtype": "float32" + } + }, + "source": "File \".49\", line 15, in forward\n to_2 = torch.ops.aten.to.dtype(unsqueeze_3, torch.float32); unsqueeze_3 = None" + }, + { + "id": "matmul", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "expand" + }, + { + "tensor": "_to_copy" + } + ], + "kwargs": {}, + "source": "File \".49\", line 20, in forward\n matmul = torch.ops.aten.matmul.default(to_3, to_4); to_3 = to_4 = None" + }, + { + "id": "transpose", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 21, in forward\n transpose = torch.ops.aten.transpose.int(matmul, 2, 3); matmul = None" + }, + { + "id": "select", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "select_1", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose" + }, + 0, + 1 + ], + "kwargs": {}, + "source": "File \".49\", line 23, in forward\n select_1 = torch.ops.aten.select.int(transpose, 0, 1)" + }, + { + "id": "slice_2", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_1" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 24, in forward\n slice_2 = torch.ops.aten.slice.Tensor(select_1, 2, 1, 33, 3); select_1 = None" + }, + { + "id": "slice_3", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 25, in forward\n slice_3 = torch.ops.aten.slice.Tensor(select, 2, 1, 33, 3)" + }, + { + "id": "copy", + "op": "aten.copy.default", + "args": [ + { + "tensor": "slice_3" + }, + { + "tensor": "slice_2" + } + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_1", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "select_2", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_1" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "slice_scatter", + "op": "aten.slice_scatter.default", + "args": [ + { + "tensor": "select_2" + }, + { + "tensor": "copy" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "select_scatter", + "op": "aten.select_scatter.default", + "args": [ + { + "tensor": "transpose_1" + }, + { + "tensor": "slice_scatter" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_2", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "select_scatter" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_7", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "select_7", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_7" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "slice_7", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_7" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "transpose_8", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "select_8", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_8" + }, + 0, + 2 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "slice_8", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_8" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "copy_1", + "op": "aten.copy.default", + "args": [ + { + "tensor": "slice_7" + }, + { + "tensor": "slice_8" + } + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_9", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "select_9", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_9" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "slice_scatter_1", + "op": "aten.slice_scatter.default", + "args": [ + { + "tensor": "select_9" + }, + { + "tensor": "copy_1" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "select_scatter_1", + "op": "aten.select_scatter.default", + "args": [ + { + "tensor": "transpose_9" + }, + { + "tensor": "slice_scatter_1" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_10", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "select_scatter_1" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_12", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_10" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "select_11", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_12" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "cat", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "select_11" + }, + { + "tensor": "select_11" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \".49\", line 31, in forward\n cat = torch.ops.aten.cat.default([select, select], -1); select = None" + }, + { + "id": "cos", + "op": "aten.cos.default", + "args": [ + { + "tensor": "cat" + } + ], + "kwargs": {}, + "source": "File \".49\", line 32, in forward\n cos = torch.ops.aten.cos.default(cat)" + }, + { + "id": "mul", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cos" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \".49\", line 33, in forward\n mul = torch.ops.aten.mul.Tensor(cos, 1.0); cos = None" + }, + { + "id": "sin", + "op": "aten.sin.default", + "args": [ + { + "tensor": "cat" + } + ], + "kwargs": {}, + "source": "File \".49\", line 34, in forward\n sin = torch.ops.aten.sin.default(cat); cat = None" + }, + { + "id": "mul_1", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "sin" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \".49\", line 35, in forward\n mul_1 = torch.ops.aten.mul.Tensor(sin, 1.0); sin = None" + }, + { + "id": "pow_1", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "where" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_1" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_2", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "where" + }, + { + "tensor": "rsqrt" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_1", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_3", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_2" + }, + { + "tensor": "add_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_3" + }, + { + "tensor": "where" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_13", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_1", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_1" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_2", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_3", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_1", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_0" + }, + { + "tensor": "transpose_13" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_10", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_1" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_4", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_1" + }, + { + "tensor": "unsqueeze_4" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_11", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_12", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_14", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_12" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_13", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_14", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_15", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_1", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_13" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_2", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_14" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_3", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_15" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_2", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_3" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_4", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg" + }, + { + "tensor": "softplus" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_5", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_1" + }, + { + "tensor": "view_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_1", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_5" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_3", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_1" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_1", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_6", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_1" + }, + { + "tensor": "rsqrt_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_7", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_2" + }, + { + "tensor": "view_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_2", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_7" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_4", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_2" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_2", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_8", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_2" + }, + { + "tensor": "rsqrt_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_6" + }, + { + "tensor": "mul_8" + }, + { + "tensor": "view_3" + }, + { + "tensor": "mul_4" + }, + { + "tensor": "sigmoid" + }, + { + "tensor": "states_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_16", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_17", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_15", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_17" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_15" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_4", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_5", + "op": "aten.view.default", + "args": [ + { + "tensor": "view" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_2", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_4" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_1", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_2" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_5", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_1" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_3", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_9", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_4" + }, + { + "tensor": "rsqrt_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_10", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_norm_weight" + }, + { + "tensor": "mul_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_1", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_11", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_10" + }, + { + "tensor": "silu_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_6", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_11" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_4", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_6" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_6", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "where" + }, + { + "tensor": "linear_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_3", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_6" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_2", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_3" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_7", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_2" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_4", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_12", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_6" + }, + { + "tensor": "rsqrt_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_8", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_13", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_12" + }, + { + "tensor": "add_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_1", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_13" + }, + { + "tensor": "add_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_5", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_1" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_2", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_6", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_1" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_14", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_2" + }, + { + "tensor": "linear_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_7", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_14" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_9", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_6" + }, + { + "tensor": "linear_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_4", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_9" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_3", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_4" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_10", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_3" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_5", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_15", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_9" + }, + { + "tensor": "rsqrt_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_11", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_16", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_15" + }, + { + "tensor": "add_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_2", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_16" + }, + { + "tensor": "add_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_8", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_16", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_9", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_7", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_9" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_10", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_11", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_2", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_2" + }, + { + "tensor": "transpose_16" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_18", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_2" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_1", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_5", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_1", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_2" + }, + { + "tensor": "unsqueeze_5" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_19", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_1" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_3", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_20", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_3" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_17", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_20" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_21", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_22", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_23", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_8", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_21" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_9", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_22" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_10", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_23" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_1", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_1", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_1", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_12", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_11" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_1", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_17", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_1" + }, + { + "tensor": "softplus_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_18", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_8" + }, + { + "tensor": "view_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_3", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_18" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_13", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_3" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_6", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_19", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_8" + }, + { + "tensor": "rsqrt_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_20", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_9" + }, + { + "tensor": "view_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_4", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_20" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_14", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_4" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_7", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_21", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_9" + }, + { + "tensor": "rsqrt_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_1", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_19" + }, + { + "tensor": "mul_21" + }, + { + "tensor": "view_10" + }, + { + "tensor": "mul_17" + }, + { + "tensor": "sigmoid_1" + }, + { + "tensor": "states_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_24", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_1" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_25", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_1" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_18", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_25" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_1", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_18" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_11", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_1" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_12", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_7" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_5", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_11" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_4", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_5" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_15", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_4" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_8", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_22", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_11" + }, + { + "tensor": "rsqrt_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_23", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_norm_weight" + }, + { + "tensor": "mul_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_4", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_24", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_23" + }, + { + "tensor": "silu_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_13", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_24" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_12", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_13" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_16", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_9" + }, + { + "tensor": "linear_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_6", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_16" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_5", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_6" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_17", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_5" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_9", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_25", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_16" + }, + { + "tensor": "rsqrt_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_18", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_26", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_25" + }, + { + "tensor": "add_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_3", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_26" + }, + { + "tensor": "add_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_13", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_3" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_5", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_14", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_3" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_27", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_5" + }, + { + "tensor": "linear_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_15", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_27" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_19", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_16" + }, + { + "tensor": "linear_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_7", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_19" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_6", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_7" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_20", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_6" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_10", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_28", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_19" + }, + { + "tensor": "rsqrt_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_21", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_29", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_28" + }, + { + "tensor": "add_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_4", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_29" + }, + { + "tensor": "add_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_16", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_19", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_16" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_17", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_14", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_17" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_18", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_19", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_3", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_4" + }, + { + "tensor": "transpose_19" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_26", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_3" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_2", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_6", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_2" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_2", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_3" + }, + { + "tensor": "unsqueeze_6" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_27", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_2" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_6", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_28", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_6" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_20", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_28" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_29", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_30", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_31", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_15", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_29" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_16", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_30" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_17", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_31" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_2", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_2", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_2", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_22", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_19" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_2", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_30", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_2" + }, + { + "tensor": "softplus_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_31", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_15" + }, + { + "tensor": "view_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_5", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_31" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_23", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_5" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_11", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_32", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_15" + }, + { + "tensor": "rsqrt_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_33", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_16" + }, + { + "tensor": "view_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_6", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_33" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_24", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_6" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_12", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_34", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_16" + }, + { + "tensor": "rsqrt_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_2", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_32" + }, + { + "tensor": "mul_34" + }, + { + "tensor": "view_17" + }, + { + "tensor": "mul_30" + }, + { + "tensor": "sigmoid_2" + }, + { + "tensor": "states_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_32", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_2" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_33", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_2" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_21", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_33" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_2", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_21" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_18", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_2" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_19", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_14" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_8", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_18" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_7", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_8" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_25", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_7" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_13", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_35", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_18" + }, + { + "tensor": "rsqrt_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_36", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_norm_weight" + }, + { + "tensor": "mul_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_7", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_37", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_36" + }, + { + "tensor": "silu_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_20", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_37" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_20", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_20" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_26", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_19" + }, + { + "tensor": "linear_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_9", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_26" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_8", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_9" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_27", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_8" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_14", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_38", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_26" + }, + { + "tensor": "rsqrt_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_28", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_39", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_38" + }, + { + "tensor": "add_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_5", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_39" + }, + { + "tensor": "add_26" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_21", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_5" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_8", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_22", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_5" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_40", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_8" + }, + { + "tensor": "linear_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_23", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_40" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_29", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_26" + }, + { + "tensor": "linear_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_10", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_29" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_9", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_10" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_30", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_9" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_15", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_41", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_29" + }, + { + "tensor": "rsqrt_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_31", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_42", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_41" + }, + { + "tensor": "add_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_6", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_42" + }, + { + "tensor": "add_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_24", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_21", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_24" + }, + [ + 1, + 16, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_34", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_21" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_35", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_21" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_3", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_35" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_3" + }, + [ + 1, + 16, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_22", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_34" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_11", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_22" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_10", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_11" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_32", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_10" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_16", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_43", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_22" + }, + { + "tensor": "rsqrt_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_33", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_44", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_43" + }, + { + "tensor": "add_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_7", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_44" + }, + { + "tensor": "view_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_22", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_7" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_25", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_23", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_25" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_12", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_23" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_11", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_12" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_34", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_11" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_17", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_45", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_23" + }, + { + "tensor": "rsqrt_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_35", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_46", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_45" + }, + { + "tensor": "add_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_8", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_46" + }, + { + "tensor": "view_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_23", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_26", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_24", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_26" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_24", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_24" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_7", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_8", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_36", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_22" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_37", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_22" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_38", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_23" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_39", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_23" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_47", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + { + "tensor": "unsqueeze_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_40", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_41", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_3", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_4", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_3" + }, + { + "tensor": "slice_40" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_48", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_4" + }, + { + "tensor": "unsqueeze_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_36", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_47" + }, + { + "tensor": "mul_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_49", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + { + "tensor": "unsqueeze_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_42", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_43", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_4", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_5", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_4" + }, + { + "tensor": "slice_42" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_50", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_5" + }, + { + "tensor": "unsqueeze_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_37", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_49" + }, + { + "tensor": "mul_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_6", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_36" + }, + { + "tensor": "slice_37" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_7", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_37" + }, + { + "tensor": "slice_39" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_6" + }, + { + "tensor": "cat_7" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_1", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_7" + }, + { + "tensor": "transpose_24" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_9", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_1", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_9" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_4", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_1" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_1", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_4" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_10", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_1" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_2", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_10" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_5", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_2" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_2", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_5" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_25", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_1" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_1", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_6" + }, + { + "tensor": "transpose_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_51", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_1" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_38", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_51" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_38" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_2", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax" + }, + { + "tensor": "_unsafe_view_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_26", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_2" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_6", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_26" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_25", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_6" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_3", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_52", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_25" + }, + { + "tensor": "sigmoid_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_27", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_52" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_39", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_29" + }, + { + "tensor": "linear_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_13", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_39" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_12", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_13" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_40", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_12" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_18", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_40" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_53", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_39" + }, + { + "tensor": "rsqrt_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_41", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_54", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_53" + }, + { + "tensor": "add_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_9", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_54" + }, + { + "tensor": "add_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_28", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_9" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_9", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_29", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_9" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_55", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_9" + }, + { + "tensor": "linear_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_30", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_55" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_42", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_39" + }, + { + "tensor": "linear_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_14", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_42" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_13", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_14" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_43", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_13" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_19", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_56", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_42" + }, + { + "tensor": "rsqrt_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_44", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_57", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_56" + }, + { + "tensor": "add_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_10", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_57" + }, + { + "tensor": "add_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_31", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_27", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_31" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_32", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_26", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_32" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_33", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_34", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_8", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_8" + }, + { + "tensor": "transpose_27" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_44", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_8" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_3", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_11", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_3" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_3", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_8" + }, + { + "tensor": "unsqueeze_11" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_45", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_3" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_10", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_46", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_10" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_28", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_46" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_47", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_48", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_49", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_27", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_47" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_28", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_48" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_29", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_49" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_4", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_3", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_5", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_45", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_34" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_3", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_58", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_5" + }, + { + "tensor": "softplus_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_59", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_27" + }, + { + "tensor": "view_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_7", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_59" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_46", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_7" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_20", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_60", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_27" + }, + { + "tensor": "rsqrt_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_61", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_28" + }, + { + "tensor": "view_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_8", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_61" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_47", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_8" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_21", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_62", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_28" + }, + { + "tensor": "rsqrt_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_3", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_60" + }, + { + "tensor": "mul_62" + }, + { + "tensor": "view_29" + }, + { + "tensor": "mul_58" + }, + { + "tensor": "sigmoid_4" + }, + { + "tensor": "states_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_50", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_3" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_51", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_3" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_29", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_51" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_7", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_29" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_30", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_7" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_31", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_26" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_15", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_30" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_14", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_15" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_48", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_14" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_22", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_63", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_30" + }, + { + "tensor": "rsqrt_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_64", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_norm_weight" + }, + { + "tensor": "mul_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_11", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_65", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_64" + }, + { + "tensor": "silu_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_32", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_65" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_35", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_32" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_49", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_42" + }, + { + "tensor": "linear_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_16", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_49" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_15", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_16" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_50", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_15" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_23", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_66", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_49" + }, + { + "tensor": "rsqrt_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_51", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_67", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_66" + }, + { + "tensor": "add_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_11", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_67" + }, + { + "tensor": "add_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_36", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_11" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_12", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_37", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_11" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_68", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_12" + }, + { + "tensor": "linear_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_38", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_68" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_52", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_49" + }, + { + "tensor": "linear_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_17", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_52" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_16", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_17" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_53", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_16" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_24", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_69", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_52" + }, + { + "tensor": "rsqrt_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_54", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_70", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_69" + }, + { + "tensor": "add_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_12", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_70" + }, + { + "tensor": "add_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_39", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_30", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_39" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_40", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_33", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_40" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_41", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_42", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_9", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_10" + }, + { + "tensor": "transpose_30" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_52", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_9" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_4", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_12", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_4" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_4", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_9" + }, + { + "tensor": "unsqueeze_12" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_53", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_4" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_13", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_54", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_13" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_31", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_54" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_55", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_56", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_57", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_34", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_55" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_35", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_56" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_36", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_57" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_5", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_4", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_6", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_55", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_42" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_4", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_55" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_71", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_6" + }, + { + "tensor": "softplus_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_72", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_34" + }, + { + "tensor": "view_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_9", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_72" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_56", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_9" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_25", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_56" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_73", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_34" + }, + { + "tensor": "rsqrt_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_74", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_35" + }, + { + "tensor": "view_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_10", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_74" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_57", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_10" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_26", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_75", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_35" + }, + { + "tensor": "rsqrt_26" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_4", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_73" + }, + { + "tensor": "mul_75" + }, + { + "tensor": "view_36" + }, + { + "tensor": "mul_71" + }, + { + "tensor": "sigmoid_5" + }, + { + "tensor": "states_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_58", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_4" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_59", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_4" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_32", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_59" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_8", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_32" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_37", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_8" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_38", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_33" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_18", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_37" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_17", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_18" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_58", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_17" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_27", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_76", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_37" + }, + { + "tensor": "rsqrt_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_77", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_norm_weight" + }, + { + "tensor": "mul_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_14", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_78", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_77" + }, + { + "tensor": "silu_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_39", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_78" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_43", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_39" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_59", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_52" + }, + { + "tensor": "linear_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_19", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_59" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_18", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_19" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_60", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_18" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_28", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_79", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_59" + }, + { + "tensor": "rsqrt_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_61", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_80", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_79" + }, + { + "tensor": "add_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_13", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_80" + }, + { + "tensor": "add_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_44", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_13" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_15", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_45", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_13" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_81", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_15" + }, + { + "tensor": "linear_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_46", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_81" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_62", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_59" + }, + { + "tensor": "linear_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_20", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_62" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_19", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_20" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_63", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_19" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_29", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_82", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_62" + }, + { + "tensor": "rsqrt_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_64", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_83", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_82" + }, + { + "tensor": "add_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_14", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_83" + }, + { + "tensor": "add_62" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_47", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_33", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_47" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_48", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_40", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_48" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_49", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_50", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_10", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_12" + }, + { + "tensor": "transpose_33" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_60", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_10" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_5", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_13", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_5" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_5", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_10" + }, + { + "tensor": "unsqueeze_13" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_61", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_5" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_16", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_62", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_16" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_34", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_62" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_63", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_64", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_65", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_41", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_63" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_42", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_64" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_43", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_65" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_6", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_5", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_7", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_65", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_50" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_5", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_65" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_84", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_7" + }, + { + "tensor": "softplus_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_85", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_41" + }, + { + "tensor": "view_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_11", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_85" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_66", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_11" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_30", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_86", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_41" + }, + { + "tensor": "rsqrt_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_87", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_42" + }, + { + "tensor": "view_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_12", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_87" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_67", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_12" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_31", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_88", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_42" + }, + { + "tensor": "rsqrt_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_5", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_86" + }, + { + "tensor": "mul_88" + }, + { + "tensor": "view_43" + }, + { + "tensor": "mul_84" + }, + { + "tensor": "sigmoid_6" + }, + { + "tensor": "states_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_66", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_5" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_67", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_5" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_35", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_67" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_9", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_35" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_44", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_9" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_45", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_40" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_21", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_44" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_20", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_21" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_68", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_20" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_32", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_89", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_44" + }, + { + "tensor": "rsqrt_32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_90", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_norm_weight" + }, + { + "tensor": "mul_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_17", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_91", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_90" + }, + { + "tensor": "silu_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_46", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_91" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_51", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_46" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_69", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_62" + }, + { + "tensor": "linear_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_22", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_69" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_21", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_22" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_70", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_21" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_33", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_70" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_92", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_69" + }, + { + "tensor": "rsqrt_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_71", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_93", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_92" + }, + { + "tensor": "add_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_15", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_93" + }, + { + "tensor": "add_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_52", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_15" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_18", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_53", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_15" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_94", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_18" + }, + { + "tensor": "linear_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_54", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_94" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_72", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_69" + }, + { + "tensor": "linear_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_23", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_72" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_22", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_23" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_73", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_22" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_34", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_73" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_95", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_72" + }, + { + "tensor": "rsqrt_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_74", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_96", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_95" + }, + { + "tensor": "add_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_16", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_96" + }, + { + "tensor": "add_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_55", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_47", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_55" + }, + [ + 1, + 16, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_68", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_47" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_69", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_47" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_10", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_69" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_3", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_10" + }, + [ + 1, + 16, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_48", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_68" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_24", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_48" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_23", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_24" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_75", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_23" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_35", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_97", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_48" + }, + { + "tensor": "rsqrt_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_76", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_98", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_97" + }, + { + "tensor": "add_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_17", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_98" + }, + { + "tensor": "view_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_36", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_17" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_56", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_49", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_56" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_25", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_49" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_24", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_25" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_77", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_24" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_36", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_99", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_49" + }, + { + "tensor": "rsqrt_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_78", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_100", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_99" + }, + { + "tensor": "add_78" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_18", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_100" + }, + { + "tensor": "view_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_37", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_18" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_57", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_50", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_57" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_38", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_50" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_14", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_15", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_70", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_36" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_71", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_36" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_72", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_37" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_73", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_37" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_101", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + { + "tensor": "unsqueeze_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_74", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_75", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_8", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_11", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_8" + }, + { + "tensor": "slice_74" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_102", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_11" + }, + { + "tensor": "unsqueeze_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_79", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_101" + }, + { + "tensor": "mul_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_103", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + { + "tensor": "unsqueeze_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_76", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_77", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_9", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_12", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_9" + }, + { + "tensor": "slice_76" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_104", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_12" + }, + { + "tensor": "unsqueeze_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_80", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_103" + }, + { + "tensor": "mul_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_13", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_79" + }, + { + "tensor": "slice_71" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_14", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_80" + }, + { + "tensor": "slice_73" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_2", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_14" + }, + { + "tensor": "cat_14" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_3", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_15" + }, + { + "tensor": "transpose_38" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_16", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_2" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_3", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_16" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_11", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_3" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_4", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_11" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_17", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_3" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_4", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_17" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_12", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_4" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_5", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_12" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_39", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_4" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_3", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_13" + }, + { + "tensor": "transpose_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_105", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_3" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_81", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_105" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_1", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_81" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_4", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_1" + }, + { + "tensor": "_unsafe_view_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_40", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_4" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_13", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_40" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_51", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_13" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_7", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_106", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_51" + }, + { + "tensor": "sigmoid_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_58", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_106" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_82", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_72" + }, + { + "tensor": "linear_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_26", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_82" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_25", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_26" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_83", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_25" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_37", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_107", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_82" + }, + { + "tensor": "rsqrt_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_84", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_108", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_107" + }, + { + "tensor": "add_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_19", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_108" + }, + { + "tensor": "add_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_59", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_19" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_19", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_60", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_19" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_109", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_19" + }, + { + "tensor": "linear_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_61", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_109" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_85", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_82" + }, + { + "tensor": "linear_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_27", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_85" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_26", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_27" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_86", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_26" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_38", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_110", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_85" + }, + { + "tensor": "rsqrt_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_87", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_111", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_110" + }, + { + "tensor": "add_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_20", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_111" + }, + { + "tensor": "add_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_62", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_41", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_62" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_63", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_52", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_63" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_64", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_65", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_15", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_16" + }, + { + "tensor": "transpose_41" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_78", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_15" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_6", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_18", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_6" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_6", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_15" + }, + { + "tensor": "unsqueeze_18" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_79", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_6" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_20", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_80", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_20" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_42", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_80" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_81", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_82", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_83", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_53", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_81" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_54", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_82" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_55", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_83" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_8", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_6", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_10", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_88", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_65" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_6", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_88" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_112", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_10" + }, + { + "tensor": "softplus_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_113", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_53" + }, + { + "tensor": "view_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_13", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_113" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_89", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_13" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_39", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_114", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_53" + }, + { + "tensor": "rsqrt_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_115", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_54" + }, + { + "tensor": "view_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_14", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_115" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_90", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_14" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_40", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_116", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_54" + }, + { + "tensor": "rsqrt_40" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_6", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_114" + }, + { + "tensor": "mul_116" + }, + { + "tensor": "view_55" + }, + { + "tensor": "mul_112" + }, + { + "tensor": "sigmoid_8" + }, + { + "tensor": "states_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_84", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_6" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_85", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_6" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_43", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_85" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_14", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_43" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_56", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_14" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_57", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_52" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_28", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_56" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_27", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_28" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_91", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_27" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_41", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_117", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_56" + }, + { + "tensor": "rsqrt_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_118", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_norm_weight" + }, + { + "tensor": "mul_117" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_21", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_119", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_118" + }, + { + "tensor": "silu_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_58", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_119" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_66", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_58" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_92", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_85" + }, + { + "tensor": "linear_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_29", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_92" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_28", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_29" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_93", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_28" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_42", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_120", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_92" + }, + { + "tensor": "rsqrt_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_94", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_121", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_120" + }, + { + "tensor": "add_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_21", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_121" + }, + { + "tensor": "add_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_67", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_21" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_22", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_68", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_21" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_122", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_22" + }, + { + "tensor": "linear_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_69", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_122" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_95", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_92" + }, + { + "tensor": "linear_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_30", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_95" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_29", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_30" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_96", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_29" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_43", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_96" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_123", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_95" + }, + { + "tensor": "rsqrt_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_97", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_124", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_123" + }, + { + "tensor": "add_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_22", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_124" + }, + { + "tensor": "add_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_70", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_44", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_70" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_71", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_59", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_71" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_72", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_73", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_16", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_18" + }, + { + "tensor": "transpose_44" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_86", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_16" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_7", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_19", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_7" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_7", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_16" + }, + { + "tensor": "unsqueeze_19" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_87", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_7" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_23", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_88", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_23" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_45", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_88" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_89", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_90", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_91", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_60", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_89" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_61", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_90" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_62", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_91" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_9", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_7", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_11", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_98", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_73" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_7", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_125", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_11" + }, + { + "tensor": "softplus_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_126", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_60" + }, + { + "tensor": "view_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_15", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_126" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_99", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_15" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_44", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_127", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_60" + }, + { + "tensor": "rsqrt_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_128", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_61" + }, + { + "tensor": "view_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_16", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_128" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_100", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_16" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_45", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_129", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_61" + }, + { + "tensor": "rsqrt_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_7", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_127" + }, + { + "tensor": "mul_129" + }, + { + "tensor": "view_62" + }, + { + "tensor": "mul_125" + }, + { + "tensor": "sigmoid_9" + }, + { + "tensor": "states_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_92", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_7" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_93", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_7" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_46", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_93" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_15", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_46" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_63", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_15" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_64", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_59" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_31", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_63" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_30", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_31" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_101", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_30" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_46", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_130", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_63" + }, + { + "tensor": "rsqrt_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_131", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_norm_weight" + }, + { + "tensor": "mul_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_24", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_132", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_131" + }, + { + "tensor": "silu_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_65", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_132" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_74", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_65" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_102", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_95" + }, + { + "tensor": "linear_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_32", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_102" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_31", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_32" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_103", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_31" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_47", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_133", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_102" + }, + { + "tensor": "rsqrt_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_104", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_134", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_133" + }, + { + "tensor": "add_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_23", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_134" + }, + { + "tensor": "add_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_75", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_23" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_25", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_76", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_23" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_135", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_25" + }, + { + "tensor": "linear_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_77", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_135" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_105", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_102" + }, + { + "tensor": "linear_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_33", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_105" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_32", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_33" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_106", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_32" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_48", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_136", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_105" + }, + { + "tensor": "rsqrt_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_107", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_137", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_136" + }, + { + "tensor": "add_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_24", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_137" + }, + { + "tensor": "add_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_78", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_47", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_78" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_79", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_66", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_79" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_80", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_81", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_17", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_20" + }, + { + "tensor": "transpose_47" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_94", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_17" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_8", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_20", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_8" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_8", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_17" + }, + { + "tensor": "unsqueeze_20" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_95", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_8" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_26", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_96", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_26" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_48", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_96" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_97", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_98", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_99", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_67", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_97" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_68", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_98" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_69", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_99" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_10", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_8", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_12", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_108", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_81" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_8", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_138", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_12" + }, + { + "tensor": "softplus_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_139", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_67" + }, + { + "tensor": "view_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_17", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_139" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_109", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_17" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_49", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_140", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_67" + }, + { + "tensor": "rsqrt_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_141", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_68" + }, + { + "tensor": "view_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_18", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_141" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_110", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_18" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_50", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_110" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_142", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_68" + }, + { + "tensor": "rsqrt_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_8", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_140" + }, + { + "tensor": "mul_142" + }, + { + "tensor": "view_69" + }, + { + "tensor": "mul_138" + }, + { + "tensor": "sigmoid_10" + }, + { + "tensor": "states_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_100", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_8" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_101", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_8" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_49", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_101" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_16", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_49" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_70", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_16" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_71", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_66" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_34", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_70" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_33", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_34" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_111", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_33" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_51", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_143", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_70" + }, + { + "tensor": "rsqrt_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_144", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_norm_weight" + }, + { + "tensor": "mul_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_27", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_145", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_144" + }, + { + "tensor": "silu_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_72", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_145" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_82", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_72" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_112", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_105" + }, + { + "tensor": "linear_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_35", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_112" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_34", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_35" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_113", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_34" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_52", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_146", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_112" + }, + { + "tensor": "rsqrt_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_114", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_147", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_146" + }, + { + "tensor": "add_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_25", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_147" + }, + { + "tensor": "add_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_83", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_25" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_28", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_84", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_25" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_148", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_28" + }, + { + "tensor": "linear_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_85", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_148" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_115", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_112" + }, + { + "tensor": "linear_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_36", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_115" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_35", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_36" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_116", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_35" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_53", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_149", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_115" + }, + { + "tensor": "rsqrt_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_117", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_150", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_149" + }, + { + "tensor": "add_117" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_26", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_150" + }, + { + "tensor": "add_115" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_86", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_73", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_86" + }, + [ + 1, + 16, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_102", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_73" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_103", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_73" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_17", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_103" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_6", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_17" + }, + [ + 1, + 16, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_74", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_102" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_37", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_74" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_36", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_37" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_118", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_36" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_54", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_118" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_151", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_74" + }, + { + "tensor": "rsqrt_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_119", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_152", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_151" + }, + { + "tensor": "add_119" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_27", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_152" + }, + { + "tensor": "view_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_50", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_27" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_87", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_75", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_87" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_38", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_75" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_37", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_38" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_120", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_37" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_55", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_153", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_75" + }, + { + "tensor": "rsqrt_55" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_121", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_154", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_153" + }, + { + "tensor": "add_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_28", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_154" + }, + { + "tensor": "view_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_51", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_28" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_88", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_76", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_88" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_52", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_76" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_21", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_22", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_104", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_50" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_105", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_50" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_106", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_51" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_107", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_51" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_155", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + { + "tensor": "unsqueeze_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_108", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_109", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_13", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_18", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_13" + }, + { + "tensor": "slice_108" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_156", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_18" + }, + { + "tensor": "unsqueeze_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_122", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_155" + }, + { + "tensor": "mul_156" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_157", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + { + "tensor": "unsqueeze_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_110", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_111", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_14", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_19", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_14" + }, + { + "tensor": "slice_110" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_158", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_19" + }, + { + "tensor": "unsqueeze_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_123", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_157" + }, + { + "tensor": "mul_158" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_20", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_122" + }, + { + "tensor": "slice_105" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_21", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_123" + }, + { + "tensor": "slice_107" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_4", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_22" + }, + { + "tensor": "cat_21" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_5", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_23" + }, + { + "tensor": "transpose_52" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_23", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_4" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_5", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_23" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_18", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_5" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_7", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_18" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_24", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_5" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_6", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_24" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_19", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_6" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_8", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_19" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_53", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_7" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_5", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_20" + }, + { + "tensor": "transpose_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_159", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_5" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_124", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_159" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_2", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_124" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_6", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_2" + }, + { + "tensor": "_unsafe_view_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_54", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_6" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_20", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_54" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_77", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_20" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_11", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_160", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_77" + }, + { + "tensor": "sigmoid_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_89", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_160" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_125", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_115" + }, + { + "tensor": "linear_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_39", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_125" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_38", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_39" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_126", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_38" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_56", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_161", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_125" + }, + { + "tensor": "rsqrt_56" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_127", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_162", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_161" + }, + { + "tensor": "add_127" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_29", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_162" + }, + { + "tensor": "add_125" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_90", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_29" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_29", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_91", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_29" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_163", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_29" + }, + { + "tensor": "linear_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_92", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_163" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_128", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_125" + }, + { + "tensor": "linear_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_40", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_128" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_39", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_40" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_129", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_39" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_57", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_164", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_128" + }, + { + "tensor": "rsqrt_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_130", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_165", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_164" + }, + { + "tensor": "add_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_30", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_165" + }, + { + "tensor": "add_128" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_93", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_55", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_93" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_94", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_78", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_94" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_95", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_96", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_22", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_24" + }, + { + "tensor": "transpose_55" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_112", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_22" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_9", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_25", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_9" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_9", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_22" + }, + { + "tensor": "unsqueeze_25" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_113", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_9" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_30", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_114", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_30" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_56", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_114" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_115", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_116", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_117", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_79", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_115" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_80", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_116" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_81", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_117" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_12", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_9", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_15", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_131", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_96" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_9", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_166", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_15" + }, + { + "tensor": "softplus_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_167", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_79" + }, + { + "tensor": "view_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_19", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_167" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_132", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_19" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_58", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_132" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_168", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_79" + }, + { + "tensor": "rsqrt_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_169", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_80" + }, + { + "tensor": "view_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_20", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_169" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_133", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_20" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_59", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_133" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_170", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_80" + }, + { + "tensor": "rsqrt_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_9", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_168" + }, + { + "tensor": "mul_170" + }, + { + "tensor": "view_81" + }, + { + "tensor": "mul_166" + }, + { + "tensor": "sigmoid_12" + }, + { + "tensor": "states_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_118", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_9" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_119", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_9" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_57", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_119" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_21", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_57" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_82", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_21" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_83", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_78" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_41", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_82" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_40", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_41" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_134", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_40" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_60", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_134" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_171", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_82" + }, + { + "tensor": "rsqrt_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_172", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_norm_weight" + }, + { + "tensor": "mul_171" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_31", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_173", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_172" + }, + { + "tensor": "silu_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_84", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_173" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_97", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_84" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_135", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_128" + }, + { + "tensor": "linear_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_42", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_135" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_41", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_42" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_136", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_41" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_61", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_136" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_174", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_135" + }, + { + "tensor": "rsqrt_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_137", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_175", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_174" + }, + { + "tensor": "add_137" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_31", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_175" + }, + { + "tensor": "add_135" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_98", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_31" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_32", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_99", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_31" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_176", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_32" + }, + { + "tensor": "linear_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_100", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_176" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_138", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_135" + }, + { + "tensor": "linear_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_43", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_138" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_42", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_43" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_139", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_42" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_62", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_177", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_138" + }, + { + "tensor": "rsqrt_62" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_140", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_178", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_177" + }, + { + "tensor": "add_140" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_32", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_178" + }, + { + "tensor": "add_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_101", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_58", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_101" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_102", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_85", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_102" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_103", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_104", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_23", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_26" + }, + { + "tensor": "transpose_58" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_120", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_23" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_10", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_26", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_10" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_10", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_23" + }, + { + "tensor": "unsqueeze_26" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_121", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_10" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_33", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_122", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_33" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_59", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_122" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_123", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_124", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_125", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_86", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_123" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_87", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_124" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_88", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_125" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_13", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_10", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_16", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_141", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_104" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_10", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_141" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_179", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_16" + }, + { + "tensor": "softplus_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_180", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_86" + }, + { + "tensor": "view_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_21", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_180" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_142", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_21" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_63", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_181", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_86" + }, + { + "tensor": "rsqrt_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_182", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_87" + }, + { + "tensor": "view_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_22", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_182" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_143", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_22" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_64", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_183", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_87" + }, + { + "tensor": "rsqrt_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_10", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_181" + }, + { + "tensor": "mul_183" + }, + { + "tensor": "view_88" + }, + { + "tensor": "mul_179" + }, + { + "tensor": "sigmoid_13" + }, + { + "tensor": "states_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_126", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_10" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_127", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_10" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_60", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_127" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_22", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_60" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_89", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_22" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_90", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_85" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_44", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_89" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_43", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_44" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_144", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_43" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_65", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_144" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_184", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_89" + }, + { + "tensor": "rsqrt_65" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_185", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_norm_weight" + }, + { + "tensor": "mul_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_34", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_186", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_185" + }, + { + "tensor": "silu_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_91", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_186" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_105", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_91" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_145", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_138" + }, + { + "tensor": "linear_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_45", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_145" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_44", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_45" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_146", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_44" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_66", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_187", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_145" + }, + { + "tensor": "rsqrt_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_147", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_188", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_187" + }, + { + "tensor": "add_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_33", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_188" + }, + { + "tensor": "add_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_106", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_33" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_35", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_107", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_33" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_189", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_35" + }, + { + "tensor": "linear_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_108", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_189" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_148", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_145" + }, + { + "tensor": "linear_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_46", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_148" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_45", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_46" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_149", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_45" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_67", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_149" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_190", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_148" + }, + { + "tensor": "rsqrt_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_150", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_191", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_190" + }, + { + "tensor": "add_150" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_34", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_191" + }, + { + "tensor": "add_148" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_109", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_61", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_109" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_110", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_92", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_110" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_111", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_112", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_24", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_28" + }, + { + "tensor": "transpose_61" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_128", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_24" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_11", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_27", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_11" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_11", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_24" + }, + { + "tensor": "unsqueeze_27" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_129", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_11" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_36", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_130", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_36" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_62", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_130" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_131", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_132", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_133", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_93", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_131" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_94", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_132" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_95", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_133" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_14", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_11", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_17", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_151", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_112" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_11", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_151" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_192", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_17" + }, + { + "tensor": "softplus_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_193", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_93" + }, + { + "tensor": "view_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_23", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_193" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_152", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_23" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_68", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_194", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_93" + }, + { + "tensor": "rsqrt_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_195", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_94" + }, + { + "tensor": "view_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_24", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_195" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_153", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_24" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_69", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_196", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_94" + }, + { + "tensor": "rsqrt_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_11", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_194" + }, + { + "tensor": "mul_196" + }, + { + "tensor": "view_95" + }, + { + "tensor": "mul_192" + }, + { + "tensor": "sigmoid_14" + }, + { + "tensor": "states_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_134", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_11" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_135", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_11" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_63", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_135" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_23", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_63" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_96", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_23" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_97", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_92" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_47", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_96" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_46", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_47" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_154", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_46" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_70", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_154" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_197", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_96" + }, + { + "tensor": "rsqrt_70" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_198", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_norm_weight" + }, + { + "tensor": "mul_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_37", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_199", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_198" + }, + { + "tensor": "silu_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_98", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_199" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_113", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_98" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_155", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_148" + }, + { + "tensor": "linear_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_48", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_155" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_47", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_48" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_156", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_47" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_71", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_156" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_200", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_155" + }, + { + "tensor": "rsqrt_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_157", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_201", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_200" + }, + { + "tensor": "add_157" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_35", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_201" + }, + { + "tensor": "add_155" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_114", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_35" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_38", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_115", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_35" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_202", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_38" + }, + { + "tensor": "linear_115" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_116", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_202" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_158", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_155" + }, + { + "tensor": "linear_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_49", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_158" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_48", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_49" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_159", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_48" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_72", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_159" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_203", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_158" + }, + { + "tensor": "rsqrt_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_160", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_204", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_203" + }, + { + "tensor": "add_160" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_36", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_204" + }, + { + "tensor": "add_158" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_117", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_99", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_117" + }, + [ + 1, + 16, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_136", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_99" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_137", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_99" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_24", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_137" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_9", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_24" + }, + [ + 1, + 16, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_100", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_136" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_50", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_100" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_49", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_50" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_161", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_49" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_73", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_161" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_205", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_100" + }, + { + "tensor": "rsqrt_73" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_162", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_206", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_205" + }, + { + "tensor": "add_162" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_37", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_206" + }, + { + "tensor": "view_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_64", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_37" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_118", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_101", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_118" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_51", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_101" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_50", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_51" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_163", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_50" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_74", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_163" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_207", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_101" + }, + { + "tensor": "rsqrt_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_164", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_208", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_207" + }, + { + "tensor": "add_164" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_38", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_208" + }, + { + "tensor": "view_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_65", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_38" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_119", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_102", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_119" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_66", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_102" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_28", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_29", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_138", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_64" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_139", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_64" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_140", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_65" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_141", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_65" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_209", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + { + "tensor": "unsqueeze_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_142", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_143", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_18", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_25", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_18" + }, + { + "tensor": "slice_142" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_210", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_25" + }, + { + "tensor": "unsqueeze_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_165", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_209" + }, + { + "tensor": "mul_210" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_211", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + { + "tensor": "unsqueeze_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_144", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_145", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_19", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_26", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_19" + }, + { + "tensor": "slice_144" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_212", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_26" + }, + { + "tensor": "unsqueeze_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_166", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_211" + }, + { + "tensor": "mul_212" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_27", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_165" + }, + { + "tensor": "slice_139" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_28", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_166" + }, + { + "tensor": "slice_141" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_6", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_30" + }, + { + "tensor": "cat_28" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_7", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_31" + }, + { + "tensor": "transpose_66" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_30", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_6" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_7", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_30" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_25", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_7" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_10", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_25" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_31", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_7" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_8", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_31" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_26", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_8" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_11", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_26" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_67", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_10" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_7", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_27" + }, + { + "tensor": "transpose_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_213", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_7" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_167", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_213" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_3", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_167" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_8", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_3" + }, + { + "tensor": "_unsafe_view_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_68", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_27", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_68" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_103", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_27" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_15", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_214", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_103" + }, + { + "tensor": "sigmoid_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_120", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_214" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_168", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_158" + }, + { + "tensor": "linear_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_52", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_168" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_51", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_52" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_169", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_51" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_75", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_169" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_215", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_168" + }, + { + "tensor": "rsqrt_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_170", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_216", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_215" + }, + { + "tensor": "add_170" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_39", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_216" + }, + { + "tensor": "add_168" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_121", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_39" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_39", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_122", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_39" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_217", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_39" + }, + { + "tensor": "linear_122" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_123", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_217" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_171", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_168" + }, + { + "tensor": "linear_123" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_53", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_171" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_52", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_53" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_172", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_52" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_76", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_172" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_218", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_171" + }, + { + "tensor": "rsqrt_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_173", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_219", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_218" + }, + { + "tensor": "add_173" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_40", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_219" + }, + { + "tensor": "add_171" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_124", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_69", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_124" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_125", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_104", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_125" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_126", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_127", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_29", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_32" + }, + { + "tensor": "transpose_69" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_146", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_29" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_12", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_32", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_12" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_12", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_29" + }, + { + "tensor": "unsqueeze_32" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_147", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_12" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_40", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_148", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_40" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_70", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_148" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_149", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_150", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_151", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_105", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_149" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_106", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_150" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_107", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_151" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_16", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_12", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_20", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_174", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_127" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_12", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_174" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_220", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_20" + }, + { + "tensor": "softplus_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_221", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_105" + }, + { + "tensor": "view_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_25", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_221" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_175", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_25" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_77", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_175" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_222", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_105" + }, + { + "tensor": "rsqrt_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_223", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_106" + }, + { + "tensor": "view_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_26", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_223" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_176", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_26" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_78", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_176" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_224", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_106" + }, + { + "tensor": "rsqrt_78" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_12", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_222" + }, + { + "tensor": "mul_224" + }, + { + "tensor": "view_107" + }, + { + "tensor": "mul_220" + }, + { + "tensor": "sigmoid_16" + }, + { + "tensor": "states_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_152", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_12" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_153", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_12" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_71", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_153" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_28", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_71" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_108", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_28" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_109", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_104" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_54", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_108" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_53", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_54" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_177", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_53" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_79", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_225", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_108" + }, + { + "tensor": "rsqrt_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_226", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_norm_weight" + }, + { + "tensor": "mul_225" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_41", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_227", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_226" + }, + { + "tensor": "silu_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_110", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_227" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_128", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_110" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_178", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_171" + }, + { + "tensor": "linear_128" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_55", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_178" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_54", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_55" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_179", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_54" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_80", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_179" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_228", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_178" + }, + { + "tensor": "rsqrt_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_180", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_229", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_228" + }, + { + "tensor": "add_180" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_41", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_229" + }, + { + "tensor": "add_178" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_129", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_41" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_42", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_130", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_41" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_230", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_42" + }, + { + "tensor": "linear_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_131", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_230" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_181", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_178" + }, + { + "tensor": "linear_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_56", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_181" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_55", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_56" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_182", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_55" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_81", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_182" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_231", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_181" + }, + { + "tensor": "rsqrt_81" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_183", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_232", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_231" + }, + { + "tensor": "add_183" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_42", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_232" + }, + { + "tensor": "add_181" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_132", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_72", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_132" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_133", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_111", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_133" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_134", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_135", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_30", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_34" + }, + { + "tensor": "transpose_72" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_154", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_30" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_13", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_33", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_13" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_13", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_30" + }, + { + "tensor": "unsqueeze_33" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_155", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_13" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_43", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_155" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_156", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_43" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_73", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_156" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_157", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_158", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_159", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_112", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_157" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_113", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_158" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_114", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_159" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_17", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_134" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_13", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_21", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_184", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_135" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_13", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_233", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_21" + }, + { + "tensor": "softplus_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_234", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_112" + }, + { + "tensor": "view_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_27", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_234" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_185", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_27" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_82", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_185" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_235", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_112" + }, + { + "tensor": "rsqrt_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_236", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_113" + }, + { + "tensor": "view_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_28", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_236" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_186", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_28" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_83", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_186" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_237", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_113" + }, + { + "tensor": "rsqrt_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_13", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_235" + }, + { + "tensor": "mul_237" + }, + { + "tensor": "view_114" + }, + { + "tensor": "mul_233" + }, + { + "tensor": "sigmoid_17" + }, + { + "tensor": "states_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_160", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_13" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_161", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_13" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_74", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_161" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_29", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_74" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_115", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_29" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_116", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_111" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_57", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_115" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_56", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_57" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_187", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_56" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_84", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_187" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_238", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_115" + }, + { + "tensor": "rsqrt_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_239", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_norm_weight" + }, + { + "tensor": "mul_238" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_44", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_240", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_239" + }, + { + "tensor": "silu_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_117", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_240" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_136", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_117" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_188", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_181" + }, + { + "tensor": "linear_136" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_58", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_188" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_57", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_58" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_189", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_57" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_85", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_189" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_241", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_188" + }, + { + "tensor": "rsqrt_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_190", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_242", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_241" + }, + { + "tensor": "add_190" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_43", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_242" + }, + { + "tensor": "add_188" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_137", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_43" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_45", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_137" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_138", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_43" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_243", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_45" + }, + { + "tensor": "linear_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_139", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_243" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_191", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_188" + }, + { + "tensor": "linear_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_59", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_191" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_58", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_59" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_192", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_58" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_86", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_192" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_244", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_191" + }, + { + "tensor": "rsqrt_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_193", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_245", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_244" + }, + { + "tensor": "add_193" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_44", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_245" + }, + { + "tensor": "add_191" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_140", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_75", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_140" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_141", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_118", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_141" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_142", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_143", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_31", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_36" + }, + { + "tensor": "transpose_75" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_162", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_31" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_14", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_34", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_14" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_14", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_31" + }, + { + "tensor": "unsqueeze_34" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_163", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_14" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_46", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_163" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_164", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_46" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_76", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_164" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_165", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_166", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_167", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_119", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_165" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_120", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_166" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_121", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_167" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_18", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_14", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_22", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_194", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_143" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_14", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_194" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_246", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_22" + }, + { + "tensor": "softplus_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_247", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_119" + }, + { + "tensor": "view_119" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_29", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_247" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_195", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_29" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_87", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_195" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_248", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_119" + }, + { + "tensor": "rsqrt_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_249", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_120" + }, + { + "tensor": "view_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_30", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_249" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_196", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_30" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_88", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_196" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_250", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_120" + }, + { + "tensor": "rsqrt_88" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_14", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_248" + }, + { + "tensor": "mul_250" + }, + { + "tensor": "view_121" + }, + { + "tensor": "mul_246" + }, + { + "tensor": "sigmoid_18" + }, + { + "tensor": "states_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_168", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_14" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_169", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_14" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_77", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_169" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_30", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_77" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_122", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_30" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_123", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_118" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_60", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_122" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_59", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_60" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_197", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_59" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_89", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_251", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_122" + }, + { + "tensor": "rsqrt_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_252", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_norm_weight" + }, + { + "tensor": "mul_251" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_47", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_123" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_253", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_252" + }, + { + "tensor": "silu_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_124", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_253" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_144", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_124" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_198", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_191" + }, + { + "tensor": "linear_144" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_61", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_198" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_60", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_61" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_199", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_60" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_90", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_199" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_254", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_198" + }, + { + "tensor": "rsqrt_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_200", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_255", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_254" + }, + { + "tensor": "add_200" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_45", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_255" + }, + { + "tensor": "add_198" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_145", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_45" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_48", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_146", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_45" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_256", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_48" + }, + { + "tensor": "linear_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_147", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_256" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_201", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_198" + }, + { + "tensor": "linear_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_62", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_201" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_61", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_62" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_202", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_61" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_91", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_202" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_257", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_201" + }, + { + "tensor": "rsqrt_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_203", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_258", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_257" + }, + { + "tensor": "add_203" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_46", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_258" + }, + { + "tensor": "add_201" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_148", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_125", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_148" + }, + [ + 1, + 16, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_170", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_125" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_171", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_125" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_31", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_171" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_12", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_31" + }, + [ + 1, + 16, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_126", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_170" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_63", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_126" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_62", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_63" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_204", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_62" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_92", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_204" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_259", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_126" + }, + { + "tensor": "rsqrt_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_205", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_260", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_259" + }, + { + "tensor": "add_205" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_47", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_260" + }, + { + "tensor": "view_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_78", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_47" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_149", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_127", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_149" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_64", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_127" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_63", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_64" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_206", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_63" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_93", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_206" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_261", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_127" + }, + { + "tensor": "rsqrt_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_207", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_262", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_261" + }, + { + "tensor": "add_207" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_48", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_262" + }, + { + "tensor": "view_127" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_79", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_48" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_150", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_128", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_150" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_80", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_128" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_35", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_36", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_172", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_78" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_173", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_78" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_174", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_79" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_175", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_79" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_263", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + { + "tensor": "unsqueeze_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_176", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_177", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_23", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_32", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_23" + }, + { + "tensor": "slice_176" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_264", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_32" + }, + { + "tensor": "unsqueeze_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_208", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_263" + }, + { + "tensor": "mul_264" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_265", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + { + "tensor": "unsqueeze_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_178", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_179", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_24", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_179" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_33", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_24" + }, + { + "tensor": "slice_178" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_266", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_33" + }, + { + "tensor": "unsqueeze_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_209", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_265" + }, + { + "tensor": "mul_266" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_34", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_208" + }, + { + "tensor": "slice_173" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_35", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_209" + }, + { + "tensor": "slice_175" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_8", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_38" + }, + { + "tensor": "cat_35" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_9", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_39" + }, + { + "tensor": "transpose_80" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_37", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_8" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_9", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_37" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_32", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_9" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_13", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_32" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_38", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_9" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_10", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_38" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_33", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_10" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_14", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_33" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_81", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_13" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_9", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_34" + }, + { + "tensor": "transpose_81" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_267", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_9" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_210", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_267" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_4", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_210" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_10", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_4" + }, + { + "tensor": "_unsafe_view_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_82", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_10" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_34", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_82" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_129", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_34" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_19", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_268", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_129" + }, + { + "tensor": "sigmoid_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_151", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_268" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_211", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_201" + }, + { + "tensor": "linear_151" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_65", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_211" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_64", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_65" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_212", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_64" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_94", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_212" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_269", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_211" + }, + { + "tensor": "rsqrt_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_213", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_270", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_269" + }, + { + "tensor": "add_213" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_49", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_270" + }, + { + "tensor": "add_211" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_152", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_49" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_49", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_153", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_49" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_271", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_49" + }, + { + "tensor": "linear_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_154", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_271" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_214", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_211" + }, + { + "tensor": "linear_154" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_66", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_214" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_65", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_66" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_215", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_65" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_95", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_215" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_272", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_214" + }, + { + "tensor": "rsqrt_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_216", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_273", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_272" + }, + { + "tensor": "add_216" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_50", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_273" + }, + { + "tensor": "add_214" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_155", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_83", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_155" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_156", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_130", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_156" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_157", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_158", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_36", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_40" + }, + { + "tensor": "transpose_83" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_180", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_36" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_15", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_39", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_15" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_15", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_36" + }, + { + "tensor": "unsqueeze_39" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_181", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_15" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_50", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_181" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_182", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_50" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_84", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_182" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_183", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_184", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_185", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_131", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_183" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_132", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_184" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_133", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_185" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_20", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_157" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_15", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_25", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_217", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_158" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_15", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_217" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_274", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_25" + }, + { + "tensor": "softplus_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_275", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_131" + }, + { + "tensor": "view_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_31", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_275" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_218", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_31" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_96", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_218" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_276", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_131" + }, + { + "tensor": "rsqrt_96" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_277", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_132" + }, + { + "tensor": "view_132" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_32", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_277" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_219", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_32" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_97", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_219" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_278", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_132" + }, + { + "tensor": "rsqrt_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_15", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_276" + }, + { + "tensor": "mul_278" + }, + { + "tensor": "view_133" + }, + { + "tensor": "mul_274" + }, + { + "tensor": "sigmoid_20" + }, + { + "tensor": "states_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_186", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_15" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_187", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_15" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_85", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_187" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_35", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_85" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_134", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_35" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_135", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_130" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_67", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_134" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_66", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_67" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_220", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_66" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_98", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_220" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_279", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_134" + }, + { + "tensor": "rsqrt_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_280", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_norm_weight" + }, + { + "tensor": "mul_279" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_51", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_135" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_281", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_280" + }, + { + "tensor": "silu_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_136", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_281" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_159", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_136" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_221", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_214" + }, + { + "tensor": "linear_159" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_68", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_221" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_67", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_68" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_222", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_67" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_99", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_222" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_282", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_221" + }, + { + "tensor": "rsqrt_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_223", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_283", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_282" + }, + { + "tensor": "add_223" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_51", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_283" + }, + { + "tensor": "add_221" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_160", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_51" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_52", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_160" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_161", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_51" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_284", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_52" + }, + { + "tensor": "linear_161" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_162", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_284" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_224", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_221" + }, + { + "tensor": "linear_162" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_69", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_224" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_68", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_69" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_225", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_68" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_100", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_225" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_285", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_224" + }, + { + "tensor": "rsqrt_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_226", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_286", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_285" + }, + { + "tensor": "add_226" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_52", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_286" + }, + { + "tensor": "add_224" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_163", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_86", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_163" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_164", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_137", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_164" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_165", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_166", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_37", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_42" + }, + { + "tensor": "transpose_86" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_188", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_37" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_16", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_40", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_16" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_16", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_37" + }, + { + "tensor": "unsqueeze_40" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_189", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_16" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_53", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_189" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_190", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_53" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_87", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_190" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_191", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_192", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_193", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_138", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_191" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_139", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_192" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_140", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_193" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_21", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_165" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_16", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_26", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_227", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_166" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_16", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_227" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_287", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_26" + }, + { + "tensor": "softplus_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_288", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_138" + }, + { + "tensor": "view_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_33", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_288" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_228", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_33" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_101", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_228" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_289", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_138" + }, + { + "tensor": "rsqrt_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_290", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_139" + }, + { + "tensor": "view_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_34", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_290" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_229", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_34" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_102", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_229" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_291", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_139" + }, + { + "tensor": "rsqrt_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_16", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_289" + }, + { + "tensor": "mul_291" + }, + { + "tensor": "view_140" + }, + { + "tensor": "mul_287" + }, + { + "tensor": "sigmoid_21" + }, + { + "tensor": "states_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_194", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_16" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_195", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_16" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_88", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_195" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_36", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_88" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_141", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_36" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_142", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_137" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_70", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_141" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_69", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_70" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_230", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_69" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_103", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_230" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_292", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_141" + }, + { + "tensor": "rsqrt_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_293", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_norm_weight" + }, + { + "tensor": "mul_292" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_54", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_294", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_293" + }, + { + "tensor": "silu_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_143", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_294" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_167", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_143" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_231", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_224" + }, + { + "tensor": "linear_167" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_71", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_231" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_70", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_71" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_232", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_70" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_104", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_232" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_295", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_231" + }, + { + "tensor": "rsqrt_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_233", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_296", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_295" + }, + { + "tensor": "add_233" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_53", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_296" + }, + { + "tensor": "add_231" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_168", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_53" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_55", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_168" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_169", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_53" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_297", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_55" + }, + { + "tensor": "linear_169" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_170", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_297" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_234", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_231" + }, + { + "tensor": "linear_170" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_72", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_234" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_71", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_72" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_235", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_71" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_105", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_235" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_298", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_234" + }, + { + "tensor": "rsqrt_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_236", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_299", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_298" + }, + { + "tensor": "add_236" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_54", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_299" + }, + { + "tensor": "add_234" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_171", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_89", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_171" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_172", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_144", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_172" + }, + [ + 1, + 16, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_173", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_174", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_38", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_44" + }, + { + "tensor": "transpose_89" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_196", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_38" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_17", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_41", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_17" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_17", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_38" + }, + { + "tensor": "unsqueeze_41" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_197", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_17" + }, + 2, + 0, + 20 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_56", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_198", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_56" + }, + 2, + -16, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_90", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_198" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_199", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_200", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_201", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_145", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_199" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_146", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_200" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_147", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_201" + }, + [ + 1, + 16, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_22", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_173" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_17", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_27", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_237", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_174" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_17", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_237" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_300", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_27" + }, + { + "tensor": "softplus_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_301", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_145" + }, + { + "tensor": "view_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_35", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_301" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_238", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_35" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_106", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_238" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_302", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_145" + }, + { + "tensor": "rsqrt_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_303", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_146" + }, + { + "tensor": "view_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_36", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_303" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_239", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_36" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_107", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_239" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_304", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_146" + }, + { + "tensor": "rsqrt_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_17", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_302" + }, + { + "tensor": "mul_304" + }, + { + "tensor": "view_147" + }, + { + "tensor": "mul_300" + }, + { + "tensor": "sigmoid_22" + }, + { + "tensor": "states_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_202", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_17" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_203", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_17" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_91", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_203" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_37", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_91" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_148", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_37" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_149", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_144" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_73", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_148" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_72", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_73" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_240", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_72" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_108", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_240" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_305", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_148" + }, + { + "tensor": "rsqrt_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_306", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_norm_weight" + }, + { + "tensor": "mul_305" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_57", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_149" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_307", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_306" + }, + { + "tensor": "silu_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_150", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_307" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_175", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_150" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_241", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_234" + }, + { + "tensor": "linear_175" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_74", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_241" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_73", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_74" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_242", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_73" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_109", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_242" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_308", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_241" + }, + { + "tensor": "rsqrt_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_243", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_309", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_308" + }, + { + "tensor": "add_243" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_55", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_309" + }, + { + "tensor": "add_241" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_176", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_55" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_58", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_176" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_177", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_55" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_310", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_58" + }, + { + "tensor": "linear_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_178", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_310" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_244", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_241" + }, + { + "tensor": "linear_178" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_75", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_244" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_74", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_75" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_245", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_74" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_110", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_245" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_311", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_244" + }, + { + "tensor": "rsqrt_110" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_246", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_312", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_311" + }, + { + "tensor": "add_246" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_56", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_312" + }, + { + "tensor": "add_244" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_179", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_151", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_179" + }, + [ + 1, + 16, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_204", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_151" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_205", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_151" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_38", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_205" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_15", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_38" + }, + [ + 1, + 16, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_152", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_204" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_76", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_152" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_75", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_76" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_247", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_75" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_111", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_247" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_313", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_152" + }, + { + "tensor": "rsqrt_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_248", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_314", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_313" + }, + { + "tensor": "add_248" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_57", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_314" + }, + { + "tensor": "view_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_92", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_57" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_180", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_153", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_180" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_77", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_153" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_76", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_77" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_249", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_76" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_112", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_249" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_315", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_153" + }, + { + "tensor": "rsqrt_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_250", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_316", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_315" + }, + { + "tensor": "add_250" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_58", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_316" + }, + { + "tensor": "view_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_93", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_58" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_181", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_154", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_181" + }, + [ + 1, + 16, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_94", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_154" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_42", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_43", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_206", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_92" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_207", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_92" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_208", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_93" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_209", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_93" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_317", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + { + "tensor": "unsqueeze_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_210", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_211", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_28", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_211" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_39", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_28" + }, + { + "tensor": "slice_210" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_318", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_39" + }, + { + "tensor": "unsqueeze_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_251", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_317" + }, + { + "tensor": "mul_318" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_319", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + { + "tensor": "unsqueeze_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_212", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_213", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_29", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_213" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_40", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_29" + }, + { + "tensor": "slice_212" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_320", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_40" + }, + { + "tensor": "unsqueeze_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_252", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_319" + }, + { + "tensor": "mul_320" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_41", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_251" + }, + { + "tensor": "slice_207" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_42", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_252" + }, + { + "tensor": "slice_209" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_10", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_46" + }, + { + "tensor": "cat_42" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_11", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_47" + }, + { + "tensor": "transpose_94" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_44", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_10" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_11", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_44" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_39", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_11" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_16", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_39" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_45", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_11" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_12", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_45" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_40", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_12" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_17", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_40" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_95", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_16" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_11", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_41" + }, + { + "tensor": "transpose_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_321", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_11" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_253", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_321" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_5", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_253" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_12", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_5" + }, + { + "tensor": "_unsafe_view_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_96", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_12" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_41", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_96" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_155", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_41" + }, + [ + 1, + 16, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_23", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_322", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_155" + }, + { + "tensor": "sigmoid_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_182", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_322" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_254", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_244" + }, + { + "tensor": "linear_182" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_78", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_254" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_77", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_78" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_255", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_77" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_113", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_255" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_323", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_254" + }, + { + "tensor": "rsqrt_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_256", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_324", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_323" + }, + { + "tensor": "add_256" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_59", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_324" + }, + { + "tensor": "add_254" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_183", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_59" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_59", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_183" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_184", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_59" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_325", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_59" + }, + { + "tensor": "linear_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_185", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_325" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_257", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_254" + }, + { + "tensor": "linear_185" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_79", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_257" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_78", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_79" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_258", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_78" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_114", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_258" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_326", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_257" + }, + { + "tensor": "rsqrt_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_259", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_327", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_326" + }, + { + "tensor": "add_259" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_60", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_327" + }, + { + "tensor": "add_257" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "alias", + "op": "aten.alias.default", + "args": [ + { + "tensor": "type_as_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1787, in forward\n logits = self.lm_head(hidden_states[:, slice_indices, :])\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_186", + "op": "aten.linear.default", + "args": [ + { + "tensor": "alias" + }, + { + "tensor": "p_model_model_language_model_embed_tokens_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1787, in forward\n logits = self.lm_head(hidden_states[:, slice_indices, :])\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + } + ], + "quantization": [], + "states": [ + { + "input": "states_0", + "output": "slice_10", + "kind": "convolution" + }, + { + "input": "states_1", + "output": "slice_16", + "kind": "recurrent" + }, + { + "input": "states_2", + "output": "slice_18", + "kind": "convolution" + }, + { + "input": "states_3", + "output": "slice_24", + "kind": "recurrent" + }, + { + "input": "states_4", + "output": "slice_26", + "kind": "convolution" + }, + { + "input": "states_5", + "output": "slice_32", + "kind": "recurrent" + }, + { + "input": "states_6", + "output": "cache_update", + "kind": "kv" + }, + { + "input": "states_7", + "output": "cache_update_1", + "kind": "kv" + }, + { + "input": "states_8", + "output": "slice_44", + "kind": "convolution" + }, + { + "input": "states_9", + "output": "slice_50", + "kind": "recurrent" + }, + { + "input": "states_10", + "output": "slice_52", + "kind": "convolution" + }, + { + "input": "states_11", + "output": "slice_58", + "kind": "recurrent" + }, + { + "input": "states_12", + "output": "slice_60", + "kind": "convolution" + }, + { + "input": "states_13", + "output": "slice_66", + "kind": "recurrent" + }, + { + "input": "states_14", + "output": "cache_update_2", + "kind": "kv" + }, + { + "input": "states_15", + "output": "cache_update_3", + "kind": "kv" + }, + { + "input": "states_16", + "output": "slice_78", + "kind": "convolution" + }, + { + "input": "states_17", + "output": "slice_84", + "kind": "recurrent" + }, + { + "input": "states_18", + "output": "slice_86", + "kind": "convolution" + }, + { + "input": "states_19", + "output": "slice_92", + "kind": "recurrent" + }, + { + "input": "states_20", + "output": "slice_94", + "kind": "convolution" + }, + { + "input": "states_21", + "output": "slice_100", + "kind": "recurrent" + }, + { + "input": "states_22", + "output": "cache_update_4", + "kind": "kv" + }, + { + "input": "states_23", + "output": "cache_update_5", + "kind": "kv" + }, + { + "input": "states_24", + "output": "slice_112", + "kind": "convolution" + }, + { + "input": "states_25", + "output": "slice_118", + "kind": "recurrent" + }, + { + "input": "states_26", + "output": "slice_120", + "kind": "convolution" + }, + { + "input": "states_27", + "output": "slice_126", + "kind": "recurrent" + }, + { + "input": "states_28", + "output": "slice_128", + "kind": "convolution" + }, + { + "input": "states_29", + "output": "slice_134", + "kind": "recurrent" + }, + { + "input": "states_30", + "output": "cache_update_6", + "kind": "kv" + }, + { + "input": "states_31", + "output": "cache_update_7", + "kind": "kv" + }, + { + "input": "states_32", + "output": "slice_146", + "kind": "convolution" + }, + { + "input": "states_33", + "output": "slice_152", + "kind": "recurrent" + }, + { + "input": "states_34", + "output": "slice_154", + "kind": "convolution" + }, + { + "input": "states_35", + "output": "slice_160", + "kind": "recurrent" + }, + { + "input": "states_36", + "output": "slice_162", + "kind": "convolution" + }, + { + "input": "states_37", + "output": "slice_168", + "kind": "recurrent" + }, + { + "input": "states_38", + "output": "cache_update_8", + "kind": "kv" + }, + { + "input": "states_39", + "output": "cache_update_9", + "kind": "kv" + }, + { + "input": "states_40", + "output": "slice_180", + "kind": "convolution" + }, + { + "input": "states_41", + "output": "slice_186", + "kind": "recurrent" + }, + { + "input": "states_42", + "output": "slice_188", + "kind": "convolution" + }, + { + "input": "states_43", + "output": "slice_194", + "kind": "recurrent" + }, + { + "input": "states_44", + "output": "slice_196", + "kind": "convolution" + }, + { + "input": "states_45", + "output": "slice_202", + "kind": "recurrent" + }, + { + "input": "states_46", + "output": "cache_update_10", + "kind": "kv" + }, + { + "input": "states_47", + "output": "cache_update_11", + "kind": "kv" + } + ], + "dispatches": [ + { + "node": "embedding__part_0", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_0_32768" + ], + "output": "embedding__part_0", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a26ccdf9414d63e640b21dbfb8191252a532ad248ad8a975bf64438d6c861edb.wgsl" + }, + { + "node": "embedding__part_1", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768" + ], + "output": "embedding__part_1", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/17b972f97cc2659712ca7c658cd186e851a248115f83a893a8a11f34b441367e.wgsl" + }, + { + "node": "embedding__part_2", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768" + ], + "output": "embedding__part_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/309f1b67894a30dd3e88cd18af63ffc51e384b6891b5f34dd1a0588344188f6e.wgsl" + }, + { + "node": "embedding__part_3", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768" + ], + "output": "embedding__part_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d418d3ee7df4b3d5c78742deeebd6338ae749b09cf5eadb52cc4e68bbd9ce3fa.wgsl" + }, + { + "node": "embedding__part_4", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768" + ], + "output": "embedding__part_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/577120bb3cdd5d1fb64df75a3d9d9bfb7df9a47cbe10c3df4702cdedda8742f2.wgsl" + }, + { + "node": "embedding__part_5", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768" + ], + "output": "embedding__part_5", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/892b773325e143ad086ac3f3475f04c606f781b0ea3261a7168d28e3bdf24b49.wgsl" + }, + { + "node": "embedding__part_6", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768" + ], + "output": "embedding__part_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/79ab685c48a01097e551291e8bb7ea554f69b07f6fd1494aaa829ddcb0eeb8d1.wgsl" + }, + { + "node": "embedding__part_7", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944" + ], + "output": "embedding__part_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bc22275618821f75af681d7a4d901fcd863aefc1ab3cf44da85ef9b0cf8b6790.wgsl" + }, + { + "node": "embedding__sum_0", + "inputs": [ + "embedding__part_0", + "embedding__part_1" + ], + "output": "embedding__sum_0", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "embedding__sum_1", + "inputs": [ + "embedding__sum_0", + "embedding__part_2" + ], + "output": "embedding__sum_1", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "embedding__sum_2", + "inputs": [ + "embedding__sum_1", + "embedding__part_3" + ], + "output": "embedding__sum_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "embedding__sum_3", + "inputs": [ + "embedding__sum_2", + "embedding__part_4" + ], + "output": "embedding__sum_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "embedding__sum_4", + "inputs": [ + "embedding__sum_3", + "embedding__part_5" + ], + "output": "embedding__sum_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "embedding__sum_5", + "inputs": [ + "embedding__sum_4", + "embedding__part_6" + ], + "output": "embedding__sum_5", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "embedding", + "inputs": [ + "embedding__sum_5", + "embedding__part_7" + ], + "output": "embedding", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "where", + "inputs": [ + "embedding", + "image_embedding", + "is_image" + ], + "output": "where", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/0169dcad370f1e983364b323dfec0c2afbd1857634efb0200e22ccc6b558d57e.wgsl" + }, + { + "node": "slice_1", + "inputs": [ + "position_ids" + ], + "output": "slice_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/a9fa5db20fa8de1de429c6850c3e40ff8180bcdb59373919b84d2438b3b17352.wgsl" + }, + { + "node": "unsqueeze", + "inputs": [ + "b_model_model_language_model_rotary_emb_inv_freq" + ], + "output": "unsqueeze", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "unsqueeze_1", + "inputs": [ + "unsqueeze" + ], + "output": "unsqueeze_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "unsqueeze_2", + "inputs": [ + "unsqueeze_1" + ], + "output": "unsqueeze_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "expand", + "inputs": [ + "unsqueeze_2" + ], + "output": "expand", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl" + }, + { + "node": "unsqueeze_3", + "inputs": [ + "slice_1" + ], + "output": "unsqueeze_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/228e9c354122040cd7c70f0bcd9445c92011bf85343add619aeb51846c885636.wgsl" + }, + { + "node": "_to_copy", + "inputs": [ + "unsqueeze_3" + ], + "output": "_to_copy", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/970aa8fd65c7e96611a4b6f30cb0b71e24bdaefff0ca117243cab1a5a7e645a9.wgsl" + }, + { + "node": "matmul", + "inputs": [ + "expand", + "_to_copy" + ], + "output": "matmul", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/1b9f4e330debc7235cfaf8f51d00fec575e09aa6116a45ea001e10ff5f09eb8c.wgsl" + }, + { + "node": "transpose", + "inputs": [ + "matmul" + ], + "output": "transpose", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl" + }, + { + "node": "select", + "inputs": [ + "transpose" + ], + "output": "select", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl" + }, + { + "node": "select_1", + "inputs": [ + "transpose" + ], + "output": "select_1", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/a1cf6b03baf18d389f0a2b95440c17125a8ecc1e633568de985d42cac6e0d1cb.wgsl" + }, + { + "node": "slice_2", + "inputs": [ + "select_1" + ], + "output": "slice_2", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/3b8210d9acf57a3c1cca9e926547520d5994967f27ce92897a15b14137f7da66.wgsl" + }, + { + "node": "slice_3", + "inputs": [ + "select" + ], + "output": "slice_3", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/3b8210d9acf57a3c1cca9e926547520d5994967f27ce92897a15b14137f7da66.wgsl" + }, + { + "node": "copy", + "inputs": [ + "slice_2" + ], + "output": "copy", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/d44354e74d5bfca2fb879607683c5d04cb30c4e1a694270584a01c0c6b3d9be8.wgsl" + }, + { + "node": "transpose_1", + "inputs": [ + "matmul" + ], + "output": "transpose_1", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl" + }, + { + "node": "select_2", + "inputs": [ + "transpose_1" + ], + "output": "select_2", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl" + }, + { + "node": "slice_scatter", + "inputs": [ + "copy", + "select_2" + ], + "output": "slice_scatter", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/3daeb9cba5c07ed47ac55e1c2565aa82f7d8e8409037707e7339d1d96d122144.wgsl" + }, + { + "node": "select_scatter", + "inputs": [ + "slice_scatter", + "transpose_1" + ], + "output": "select_scatter", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1.wgsl" + }, + { + "node": "transpose_2", + "inputs": [ + "select_scatter" + ], + "output": "transpose_2", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957.wgsl" + }, + { + "node": "transpose_7", + "inputs": [ + "transpose_2" + ], + "output": "transpose_7", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl" + }, + { + "node": "select_7", + "inputs": [ + "transpose_7" + ], + "output": "select_7", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl" + }, + { + "node": "slice_7", + "inputs": [ + "select_7" + ], + "output": "slice_7", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec.wgsl" + }, + { + "node": "transpose_8", + "inputs": [ + "transpose_2" + ], + "output": "transpose_8", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl" + }, + { + "node": "select_8", + "inputs": [ + "transpose_8" + ], + "output": "select_8", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/deb451a300a279d0325fe3be090515d4daae6b3232d87b8e2c050991388ac00f.wgsl" + }, + { + "node": "slice_8", + "inputs": [ + "select_8" + ], + "output": "slice_8", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/5fbfe4534ce5bfff645563250dd536998f537f4d690c4c2fc422723d5af8e3ec.wgsl" + }, + { + "node": "copy_1", + "inputs": [ + "slice_8" + ], + "output": "copy_1", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/c2e7cdc03edb25ef7a160965c17c559b6ec7e139c145dc7390b73523bacba5bb.wgsl" + }, + { + "node": "transpose_9", + "inputs": [ + "transpose_2" + ], + "output": "transpose_9", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl" + }, + { + "node": "select_9", + "inputs": [ + "transpose_9" + ], + "output": "select_9", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl" + }, + { + "node": "slice_scatter_1", + "inputs": [ + "copy_1", + "select_9" + ], + "output": "slice_scatter_1", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/359d61f2ba174e54e2a0920fcf61e84e436fd3eaf7e2832e21fdb24094493667.wgsl" + }, + { + "node": "select_scatter_1", + "inputs": [ + "slice_scatter_1", + "transpose_9" + ], + "output": "select_scatter_1", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/4fa24e8f09b07271534341707a7a688af67c7deca1f114bfaeba20a2e066c9f1.wgsl" + }, + { + "node": "transpose_10", + "inputs": [ + "select_scatter_1" + ], + "output": "transpose_10", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/d155dd8abb0fe375aea320241d54486b2489a35ad76150cc77c4778bfbb9d957.wgsl" + }, + { + "node": "transpose_12", + "inputs": [ + "transpose_10" + ], + "output": "transpose_12", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/b12eae76f13225c0c5d35fc9309964aba3172712799ff3bd8538bb2c1b34aa33.wgsl" + }, + { + "node": "select_11", + "inputs": [ + "transpose_12" + ], + "output": "select_11", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/5f57b46016eccc3b50e3685e142b7deadce8f074f124e643e6e7015e2cc27357.wgsl" + }, + { + "node": "cat", + "inputs": [ + "select_11" + ], + "output": "cat", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/1a73b6fceda28f40bba4ae27a986ffa39842db94fa5903ea5bf689a7e854d4f3.wgsl" + }, + { + "node": "cos", + "inputs": [ + "cat" + ], + "output": "cos", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/764403c33cd8994568e068810380cb57e9f2e326dfc09bed63eed1fbed044da1.wgsl" + }, + { + "node": "mul", + "inputs": [ + "cos" + ], + "output": "mul", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42.wgsl" + }, + { + "node": "sin", + "inputs": [ + "cat" + ], + "output": "sin", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/ca9a3115f8f3881eee99e421cb4f259113b13bb4c107348279bb92c643a52197.wgsl" + }, + { + "node": "mul_1", + "inputs": [ + "sin" + ], + "output": "mul_1", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9b7697d3e1de37277befbd725307f40a5143faae3dcf43182d4ad89d8572ed42.wgsl" + }, + { + "node": "mul_3", + "inputs": [ + "where", + "p_model_model_language_model_layers_0_input_layernorm_weight" + ], + "output": "mul_3", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as", + "inputs": [ + "mul_3" + ], + "output": "type_as", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight" + ], + "output": "linear", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_13", + "inputs": [ + "linear" + ], + "output": "transpose_13", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_1", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight" + ], + "output": "linear_1", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view", + "inputs": [ + "linear_1" + ], + "output": "view", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_2", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight" + ], + "output": "linear_2", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_3", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight" + ], + "output": "linear_3", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_1", + "inputs": [ + "states_0", + "transpose_13" + ], + "output": "cat_1", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_10", + "inputs": [ + "cat_1" + ], + "output": "slice_10", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_0", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze", + "inputs": [ + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight" + ], + "output": "squeeze", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_4", + "inputs": [ + "squeeze" + ], + "output": "unsqueeze_4", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d", + "inputs": [ + "cat_1", + "unsqueeze_4" + ], + "output": "conv1d", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_11", + "inputs": [ + "conv1d" + ], + "output": "slice_11", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu", + "inputs": [ + "slice_11" + ], + "output": "silu", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_12", + "inputs": [ + "silu" + ], + "output": "slice_12", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_14", + "inputs": [ + "slice_12" + ], + "output": "transpose_14", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_13", + "inputs": [ + "transpose_14" + ], + "output": "slice_13", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_14", + "inputs": [ + "transpose_14" + ], + "output": "slice_14", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_15", + "inputs": [ + "transpose_14" + ], + "output": "slice_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_1", + "inputs": [ + "slice_13" + ], + "output": "view_1", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_2", + "inputs": [ + "slice_14" + ], + "output": "view_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_3", + "inputs": [ + "slice_15" + ], + "output": "view_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid", + "inputs": [ + "linear_2" + ], + "output": "sigmoid", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp", + "inputs": [ + "p_model_model_language_model_layers_0_linear_attn_a_log" + ], + "output": "exp", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg", + "inputs": [ + "exp" + ], + "output": "neg", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_2", + "inputs": [ + "linear_3", + "p_model_model_language_model_layers_0_linear_attn_dt_bias" + ], + "output": "add_2", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus", + "inputs": [ + "add_2" + ], + "output": "softplus", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_4", + "inputs": [ + "neg", + "softplus" + ], + "output": "mul_4", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_5", + "inputs": [ + "view_1" + ], + "output": "mul_5", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_1", + "inputs": [ + "mul_5" + ], + "output": "sum_1", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_3", + "inputs": [ + "sum_1" + ], + "output": "add_3", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_1", + "inputs": [ + "add_3" + ], + "output": "rsqrt_1", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_6", + "inputs": [ + "view_1", + "rsqrt_1" + ], + "output": "mul_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_7", + "inputs": [ + "view_2" + ], + "output": "mul_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_2", + "inputs": [ + "mul_7" + ], + "output": "sum_2", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_4", + "inputs": [ + "sum_2" + ], + "output": "add_4", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_2", + "inputs": [ + "add_4" + ], + "output": "rsqrt_2", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_8", + "inputs": [ + "view_2", + "rsqrt_2" + ], + "output": "mul_8", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule", + "inputs": [ + "mul_6", + "mul_8", + "view_3", + "mul_4", + "sigmoid", + "states_1" + ], + "output": "normalized_gated_delta_rule", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_16", + "inputs": [ + "normalized_gated_delta_rule" + ], + "output": "slice_16", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_1", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_17", + "inputs": [ + "normalized_gated_delta_rule" + ], + "output": "slice_17", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_15", + "inputs": [ + "slice_17" + ], + "output": "transpose_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone", + "inputs": [ + "transpose_15" + ], + "output": "clone", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_4", + "inputs": [ + "clone" + ], + "output": "view_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_5", + "inputs": [ + "view" + ], + "output": "view_5", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_10", + "inputs": [ + "view_4", + "p_model_model_language_model_layers_0_linear_attn_norm_weight" + ], + "output": "mul_10", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_11", + "inputs": [ + "view_5", + "mul_10" + ], + "output": "mul_11", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_6", + "inputs": [ + "mul_11" + ], + "output": "view_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_4", + "inputs": [ + "view_6", + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight" + ], + "output": "linear_4", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_6", + "inputs": [ + "where", + "linear_4" + ], + "output": "add_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_13", + "inputs": [ + "add_6", + "p_model_model_language_model_layers_0_post_attention_layernorm_weight" + ], + "output": "mul_13", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_1", + "inputs": [ + "mul_13" + ], + "output": "type_as_1", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_5", + "inputs": [ + "type_as_1", + "p_model_model_language_model_layers_0_mlp_gate_proj_weight" + ], + "output": "linear_5", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_6", + "inputs": [ + "type_as_1", + "p_model_model_language_model_layers_0_mlp_up_proj_weight" + ], + "output": "linear_6", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_14", + "inputs": [ + "linear_5", + "linear_6" + ], + "output": "mul_14", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_7", + "inputs": [ + "mul_14", + "p_model_model_language_model_layers_0_mlp_down_proj_weight" + ], + "output": "linear_7", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_9", + "inputs": [ + "add_6", + "linear_7" + ], + "output": "add_9", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_16", + "inputs": [ + "add_9", + "p_model_model_language_model_layers_1_input_layernorm_weight" + ], + "output": "mul_16", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_2", + "inputs": [ + "mul_16" + ], + "output": "type_as_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_8", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_8", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_16", + "inputs": [ + "linear_8" + ], + "output": "transpose_16", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_9", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight" + ], + "output": "linear_9", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_7", + "inputs": [ + "linear_9" + ], + "output": "view_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_10", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight" + ], + "output": "linear_10", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_11", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight" + ], + "output": "linear_11", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_2", + "inputs": [ + "states_2", + "transpose_16" + ], + "output": "cat_2", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_18", + "inputs": [ + "cat_2" + ], + "output": "slice_18", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_2", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_1", + "inputs": [ + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight" + ], + "output": "squeeze_1", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_5", + "inputs": [ + "squeeze_1" + ], + "output": "unsqueeze_5", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_1", + "inputs": [ + "cat_2", + "unsqueeze_5" + ], + "output": "conv1d_1", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_19", + "inputs": [ + "conv1d_1" + ], + "output": "slice_19", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_3", + "inputs": [ + "slice_19" + ], + "output": "silu_3", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_20", + "inputs": [ + "silu_3" + ], + "output": "slice_20", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_17", + "inputs": [ + "slice_20" + ], + "output": "transpose_17", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_21", + "inputs": [ + "transpose_17" + ], + "output": "slice_21", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_22", + "inputs": [ + "transpose_17" + ], + "output": "slice_22", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_23", + "inputs": [ + "transpose_17" + ], + "output": "slice_23", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_8", + "inputs": [ + "slice_21" + ], + "output": "view_8", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_9", + "inputs": [ + "slice_22" + ], + "output": "view_9", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_10", + "inputs": [ + "slice_23" + ], + "output": "view_10", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_1", + "inputs": [ + "linear_10" + ], + "output": "sigmoid_1", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_1", + "inputs": [ + "p_model_model_language_model_layers_1_linear_attn_a_log" + ], + "output": "exp_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_1", + "inputs": [ + "exp_1" + ], + "output": "neg_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_12", + "inputs": [ + "linear_11", + "p_model_model_language_model_layers_1_linear_attn_dt_bias" + ], + "output": "add_12", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_1", + "inputs": [ + "add_12" + ], + "output": "softplus_1", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_17", + "inputs": [ + "neg_1", + "softplus_1" + ], + "output": "mul_17", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_18", + "inputs": [ + "view_8" + ], + "output": "mul_18", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_3", + "inputs": [ + "mul_18" + ], + "output": "sum_3", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_13", + "inputs": [ + "sum_3" + ], + "output": "add_13", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_6", + "inputs": [ + "add_13" + ], + "output": "rsqrt_6", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_19", + "inputs": [ + "view_8", + "rsqrt_6" + ], + "output": "mul_19", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_20", + "inputs": [ + "view_9" + ], + "output": "mul_20", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_4", + "inputs": [ + "mul_20" + ], + "output": "sum_4", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_14", + "inputs": [ + "sum_4" + ], + "output": "add_14", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_7", + "inputs": [ + "add_14" + ], + "output": "rsqrt_7", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_21", + "inputs": [ + "view_9", + "rsqrt_7" + ], + "output": "mul_21", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_1", + "inputs": [ + "mul_19", + "mul_21", + "view_10", + "mul_17", + "sigmoid_1", + "states_3" + ], + "output": "normalized_gated_delta_rule_1", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_24", + "inputs": [ + "normalized_gated_delta_rule_1" + ], + "output": "slice_24", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_3", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_25", + "inputs": [ + "normalized_gated_delta_rule_1" + ], + "output": "slice_25", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_18", + "inputs": [ + "slice_25" + ], + "output": "transpose_18", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_1", + "inputs": [ + "transpose_18" + ], + "output": "clone_1", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_11", + "inputs": [ + "clone_1" + ], + "output": "view_11", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_12", + "inputs": [ + "view_7" + ], + "output": "view_12", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_23", + "inputs": [ + "view_11", + "p_model_model_language_model_layers_1_linear_attn_norm_weight" + ], + "output": "mul_23", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_24", + "inputs": [ + "view_12", + "mul_23" + ], + "output": "mul_24", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_13", + "inputs": [ + "mul_24" + ], + "output": "view_13", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_12", + "inputs": [ + "view_13", + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight" + ], + "output": "linear_12", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_16", + "inputs": [ + "add_9", + "linear_12" + ], + "output": "add_16", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_26", + "inputs": [ + "add_16", + "p_model_model_language_model_layers_1_post_attention_layernorm_weight" + ], + "output": "mul_26", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_3", + "inputs": [ + "mul_26" + ], + "output": "type_as_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_13", + "inputs": [ + "type_as_3", + "p_model_model_language_model_layers_1_mlp_gate_proj_weight" + ], + "output": "linear_13", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_14", + "inputs": [ + "type_as_3", + "p_model_model_language_model_layers_1_mlp_up_proj_weight" + ], + "output": "linear_14", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_27", + "inputs": [ + "linear_13", + "linear_14" + ], + "output": "mul_27", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_15", + "inputs": [ + "mul_27", + "p_model_model_language_model_layers_1_mlp_down_proj_weight" + ], + "output": "linear_15", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_19", + "inputs": [ + "add_16", + "linear_15" + ], + "output": "add_19", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_29", + "inputs": [ + "add_19", + "p_model_model_language_model_layers_2_input_layernorm_weight" + ], + "output": "mul_29", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_4", + "inputs": [ + "mul_29" + ], + "output": "type_as_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_16", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_16", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_19", + "inputs": [ + "linear_16" + ], + "output": "transpose_19", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_17", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight" + ], + "output": "linear_17", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_14", + "inputs": [ + "linear_17" + ], + "output": "view_14", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_18", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight" + ], + "output": "linear_18", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_19", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight" + ], + "output": "linear_19", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_3", + "inputs": [ + "states_4", + "transpose_19" + ], + "output": "cat_3", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_26", + "inputs": [ + "cat_3" + ], + "output": "slice_26", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_4", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_2", + "inputs": [ + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight" + ], + "output": "squeeze_2", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_6", + "inputs": [ + "squeeze_2" + ], + "output": "unsqueeze_6", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_2", + "inputs": [ + "cat_3", + "unsqueeze_6" + ], + "output": "conv1d_2", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_27", + "inputs": [ + "conv1d_2" + ], + "output": "slice_27", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_6", + "inputs": [ + "slice_27" + ], + "output": "silu_6", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_28", + "inputs": [ + "silu_6" + ], + "output": "slice_28", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_20", + "inputs": [ + "slice_28" + ], + "output": "transpose_20", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_29", + "inputs": [ + "transpose_20" + ], + "output": "slice_29", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_30", + "inputs": [ + "transpose_20" + ], + "output": "slice_30", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_31", + "inputs": [ + "transpose_20" + ], + "output": "slice_31", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_15", + "inputs": [ + "slice_29" + ], + "output": "view_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_16", + "inputs": [ + "slice_30" + ], + "output": "view_16", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_17", + "inputs": [ + "slice_31" + ], + "output": "view_17", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_2", + "inputs": [ + "linear_18" + ], + "output": "sigmoid_2", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_2", + "inputs": [ + "p_model_model_language_model_layers_2_linear_attn_a_log" + ], + "output": "exp_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_2", + "inputs": [ + "exp_2" + ], + "output": "neg_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_22", + "inputs": [ + "linear_19", + "p_model_model_language_model_layers_2_linear_attn_dt_bias" + ], + "output": "add_22", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_2", + "inputs": [ + "add_22" + ], + "output": "softplus_2", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_30", + "inputs": [ + "neg_2", + "softplus_2" + ], + "output": "mul_30", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_31", + "inputs": [ + "view_15" + ], + "output": "mul_31", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_5", + "inputs": [ + "mul_31" + ], + "output": "sum_5", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_23", + "inputs": [ + "sum_5" + ], + "output": "add_23", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_11", + "inputs": [ + "add_23" + ], + "output": "rsqrt_11", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_32", + "inputs": [ + "view_15", + "rsqrt_11" + ], + "output": "mul_32", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_33", + "inputs": [ + "view_16" + ], + "output": "mul_33", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_6", + "inputs": [ + "mul_33" + ], + "output": "sum_6", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_24", + "inputs": [ + "sum_6" + ], + "output": "add_24", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_12", + "inputs": [ + "add_24" + ], + "output": "rsqrt_12", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_34", + "inputs": [ + "view_16", + "rsqrt_12" + ], + "output": "mul_34", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_2", + "inputs": [ + "mul_32", + "mul_34", + "view_17", + "mul_30", + "sigmoid_2", + "states_5" + ], + "output": "normalized_gated_delta_rule_2", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_32", + "inputs": [ + "normalized_gated_delta_rule_2" + ], + "output": "slice_32", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_5", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_33", + "inputs": [ + "normalized_gated_delta_rule_2" + ], + "output": "slice_33", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_21", + "inputs": [ + "slice_33" + ], + "output": "transpose_21", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_2", + "inputs": [ + "transpose_21" + ], + "output": "clone_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_18", + "inputs": [ + "clone_2" + ], + "output": "view_18", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_19", + "inputs": [ + "view_14" + ], + "output": "view_19", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_36", + "inputs": [ + "view_18", + "p_model_model_language_model_layers_2_linear_attn_norm_weight" + ], + "output": "mul_36", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_37", + "inputs": [ + "view_19", + "mul_36" + ], + "output": "mul_37", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_20", + "inputs": [ + "mul_37" + ], + "output": "view_20", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_20", + "inputs": [ + "view_20", + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight" + ], + "output": "linear_20", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_26", + "inputs": [ + "add_19", + "linear_20" + ], + "output": "add_26", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_39", + "inputs": [ + "add_26", + "p_model_model_language_model_layers_2_post_attention_layernorm_weight" + ], + "output": "mul_39", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_5", + "inputs": [ + "mul_39" + ], + "output": "type_as_5", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_21", + "inputs": [ + "type_as_5", + "p_model_model_language_model_layers_2_mlp_gate_proj_weight" + ], + "output": "linear_21", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_22", + "inputs": [ + "type_as_5", + "p_model_model_language_model_layers_2_mlp_up_proj_weight" + ], + "output": "linear_22", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_40", + "inputs": [ + "linear_21", + "linear_22" + ], + "output": "mul_40", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_23", + "inputs": [ + "mul_40", + "p_model_model_language_model_layers_2_mlp_down_proj_weight" + ], + "output": "linear_23", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_29", + "inputs": [ + "add_26", + "linear_23" + ], + "output": "add_29", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_42", + "inputs": [ + "add_29", + "p_model_model_language_model_layers_3_input_layernorm_weight" + ], + "output": "mul_42", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_6", + "inputs": [ + "mul_42" + ], + "output": "type_as_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_24", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_q_proj_weight" + ], + "output": "linear_24", + "workgroups": [ + 512, + 2, + 1 + ], + "kernel": "kernels/4e0fada2b6f07e141f088694ab936356f2c70b66fb98e95e537c2c9d7ffb518a.wgsl" + }, + { + "node": "view_21", + "inputs": [ + "linear_24" + ], + "output": "view_21", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl" + }, + { + "node": "slice_34", + "inputs": [ + "view_21" + ], + "output": "slice_34", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl" + }, + { + "node": "slice_35", + "inputs": [ + "view_21" + ], + "output": "slice_35", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl" + }, + { + "node": "clone_3", + "inputs": [ + "slice_35" + ], + "output": "clone_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "_unsafe_view", + "inputs": [ + "clone_3" + ], + "output": "_unsafe_view", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_22", + "inputs": [ + "slice_34" + ], + "output": "view_22", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_44", + "inputs": [ + "view_22", + "p_model_model_language_model_layers_3_self_attn_q_norm_weight" + ], + "output": "mul_44", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_7", + "inputs": [ + "mul_44" + ], + "output": "type_as_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_22", + "inputs": [ + "type_as_7" + ], + "output": "transpose_22", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl" + }, + { + "node": "linear_25", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_k_proj_weight" + ], + "output": "linear_25", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_23", + "inputs": [ + "linear_25" + ], + "output": "view_23", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_46", + "inputs": [ + "view_23", + "p_model_model_language_model_layers_3_self_attn_k_norm_weight" + ], + "output": "mul_46", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_8", + "inputs": [ + "mul_46" + ], + "output": "type_as_8", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_23", + "inputs": [ + "type_as_8" + ], + "output": "transpose_23", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "linear_26", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_v_proj_weight" + ], + "output": "linear_26", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_24", + "inputs": [ + "linear_26" + ], + "output": "view_24", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_24", + "inputs": [ + "view_24" + ], + "output": "transpose_24", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "unsqueeze_7", + "inputs": [ + "mul" + ], + "output": "unsqueeze_7", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "unsqueeze_8", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_8", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "slice_36", + "inputs": [ + "transpose_22" + ], + "output": "slice_36", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl" + }, + { + "node": "slice_37", + "inputs": [ + "transpose_22" + ], + "output": "slice_37", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl" + }, + { + "node": "slice_38", + "inputs": [ + "transpose_23" + ], + "output": "slice_38", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl" + }, + { + "node": "slice_39", + "inputs": [ + "transpose_23" + ], + "output": "slice_39", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl" + }, + { + "node": "mul_47", + "inputs": [ + "slice_36", + "unsqueeze_7" + ], + "output": "mul_47", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "slice_40", + "inputs": [ + "slice_36" + ], + "output": "slice_40", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl" + }, + { + "node": "slice_41", + "inputs": [ + "slice_36" + ], + "output": "slice_41", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl" + }, + { + "node": "neg_3", + "inputs": [ + "slice_41" + ], + "output": "neg_3", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_4", + "inputs": [ + "neg_3", + "slice_40" + ], + "output": "cat_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_48", + "inputs": [ + "cat_4", + "unsqueeze_8" + ], + "output": "mul_48", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "add_36", + "inputs": [ + "mul_47", + "mul_48" + ], + "output": "add_36", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_49", + "inputs": [ + "slice_38", + "unsqueeze_7" + ], + "output": "mul_49", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "slice_42", + "inputs": [ + "slice_38" + ], + "output": "slice_42", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl" + }, + { + "node": "slice_43", + "inputs": [ + "slice_38" + ], + "output": "slice_43", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl" + }, + { + "node": "neg_4", + "inputs": [ + "slice_43" + ], + "output": "neg_4", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_5", + "inputs": [ + "neg_4", + "slice_42" + ], + "output": "cat_5", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_50", + "inputs": [ + "cat_5", + "unsqueeze_8" + ], + "output": "mul_50", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "add_37", + "inputs": [ + "mul_49", + "mul_50" + ], + "output": "add_37", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "cat_6", + "inputs": [ + "add_36", + "slice_37" + ], + "output": "cat_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cat_7", + "inputs": [ + "add_37", + "slice_39" + ], + "output": "cat_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cache_update", + "inputs": [ + "cat_7", + "cache_position" + ], + "output": "cache_update", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_6", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "cache_update_1", + "inputs": [ + "transpose_24", + "cache_position" + ], + "output": "cache_update_1", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_7", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "unsqueeze_9", + "inputs": [ + "cache_update" + ], + "output": "unsqueeze_9", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_1", + "inputs": [ + "unsqueeze_9" + ], + "output": "expand_1", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_4", + "inputs": [ + "expand_1" + ], + "output": "clone_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_1", + "inputs": [ + "clone_4" + ], + "output": "_unsafe_view_1", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_10", + "inputs": [ + "cache_update_1" + ], + "output": "unsqueeze_10", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_2", + "inputs": [ + "unsqueeze_10" + ], + "output": "expand_2", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_5", + "inputs": [ + "expand_2" + ], + "output": "clone_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_2", + "inputs": [ + "clone_5" + ], + "output": "_unsafe_view_2", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_25", + "inputs": [ + "_unsafe_view_1" + ], + "output": "transpose_25", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_1", + "inputs": [ + "cat_6", + "transpose_25" + ], + "output": "matmul_1", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl" + }, + { + "node": "mul_51", + "inputs": [ + "matmul_1" + ], + "output": "mul_51", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl" + }, + { + "node": "add_38", + "inputs": [ + "mul_51", + "attention_mask" + ], + "output": "add_38", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl" + }, + { + "node": "softmax", + "inputs": [ + "add_38" + ], + "output": "softmax", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl" + }, + { + "node": "matmul_2", + "inputs": [ + "softmax", + "_unsafe_view_2" + ], + "output": "matmul_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl" + }, + { + "node": "transpose_26", + "inputs": [ + "matmul_2" + ], + "output": "transpose_26", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl" + }, + { + "node": "clone_6", + "inputs": [ + "transpose_26" + ], + "output": "clone_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_25", + "inputs": [ + "clone_6" + ], + "output": "view_25", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_3", + "inputs": [ + "_unsafe_view" + ], + "output": "sigmoid_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl" + }, + { + "node": "mul_52", + "inputs": [ + "view_25", + "sigmoid_3" + ], + "output": "mul_52", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl" + }, + { + "node": "linear_27", + "inputs": [ + "mul_52", + "p_model_model_language_model_layers_3_self_attn_o_proj_weight" + ], + "output": "linear_27", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_39", + "inputs": [ + "add_29", + "linear_27" + ], + "output": "add_39", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_54", + "inputs": [ + "add_39", + "p_model_model_language_model_layers_3_post_attention_layernorm_weight" + ], + "output": "mul_54", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_9", + "inputs": [ + "mul_54" + ], + "output": "type_as_9", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_28", + "inputs": [ + "type_as_9", + "p_model_model_language_model_layers_3_mlp_gate_proj_weight" + ], + "output": "linear_28", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_29", + "inputs": [ + "type_as_9", + "p_model_model_language_model_layers_3_mlp_up_proj_weight" + ], + "output": "linear_29", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_55", + "inputs": [ + "linear_28", + "linear_29" + ], + "output": "mul_55", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_30", + "inputs": [ + "mul_55", + "p_model_model_language_model_layers_3_mlp_down_proj_weight" + ], + "output": "linear_30", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_42", + "inputs": [ + "add_39", + "linear_30" + ], + "output": "add_42", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_57", + "inputs": [ + "add_42", + "p_model_model_language_model_layers_4_input_layernorm_weight" + ], + "output": "mul_57", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_10", + "inputs": [ + "mul_57" + ], + "output": "type_as_10", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_31", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_31", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_27", + "inputs": [ + "linear_31" + ], + "output": "transpose_27", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_32", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight" + ], + "output": "linear_32", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_26", + "inputs": [ + "linear_32" + ], + "output": "view_26", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_33", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight" + ], + "output": "linear_33", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_34", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight" + ], + "output": "linear_34", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_8", + "inputs": [ + "states_8", + "transpose_27" + ], + "output": "cat_8", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_44", + "inputs": [ + "cat_8" + ], + "output": "slice_44", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_8", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_3", + "inputs": [ + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight" + ], + "output": "squeeze_3", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_11", + "inputs": [ + "squeeze_3" + ], + "output": "unsqueeze_11", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_3", + "inputs": [ + "cat_8", + "unsqueeze_11" + ], + "output": "conv1d_3", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_45", + "inputs": [ + "conv1d_3" + ], + "output": "slice_45", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_10", + "inputs": [ + "slice_45" + ], + "output": "silu_10", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_46", + "inputs": [ + "silu_10" + ], + "output": "slice_46", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_28", + "inputs": [ + "slice_46" + ], + "output": "transpose_28", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_47", + "inputs": [ + "transpose_28" + ], + "output": "slice_47", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_48", + "inputs": [ + "transpose_28" + ], + "output": "slice_48", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_49", + "inputs": [ + "transpose_28" + ], + "output": "slice_49", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_27", + "inputs": [ + "slice_47" + ], + "output": "view_27", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_28", + "inputs": [ + "slice_48" + ], + "output": "view_28", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_29", + "inputs": [ + "slice_49" + ], + "output": "view_29", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_4", + "inputs": [ + "linear_33" + ], + "output": "sigmoid_4", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_3", + "inputs": [ + "p_model_model_language_model_layers_4_linear_attn_a_log" + ], + "output": "exp_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_5", + "inputs": [ + "exp_3" + ], + "output": "neg_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_45", + "inputs": [ + "linear_34", + "p_model_model_language_model_layers_4_linear_attn_dt_bias" + ], + "output": "add_45", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_3", + "inputs": [ + "add_45" + ], + "output": "softplus_3", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_58", + "inputs": [ + "neg_5", + "softplus_3" + ], + "output": "mul_58", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_59", + "inputs": [ + "view_27" + ], + "output": "mul_59", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_7", + "inputs": [ + "mul_59" + ], + "output": "sum_7", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_46", + "inputs": [ + "sum_7" + ], + "output": "add_46", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_20", + "inputs": [ + "add_46" + ], + "output": "rsqrt_20", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_60", + "inputs": [ + "view_27", + "rsqrt_20" + ], + "output": "mul_60", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_61", + "inputs": [ + "view_28" + ], + "output": "mul_61", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_8", + "inputs": [ + "mul_61" + ], + "output": "sum_8", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_47", + "inputs": [ + "sum_8" + ], + "output": "add_47", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_21", + "inputs": [ + "add_47" + ], + "output": "rsqrt_21", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_62", + "inputs": [ + "view_28", + "rsqrt_21" + ], + "output": "mul_62", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_3", + "inputs": [ + "mul_60", + "mul_62", + "view_29", + "mul_58", + "sigmoid_4", + "states_9" + ], + "output": "normalized_gated_delta_rule_3", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_50", + "inputs": [ + "normalized_gated_delta_rule_3" + ], + "output": "slice_50", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_9", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_51", + "inputs": [ + "normalized_gated_delta_rule_3" + ], + "output": "slice_51", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_29", + "inputs": [ + "slice_51" + ], + "output": "transpose_29", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_7", + "inputs": [ + "transpose_29" + ], + "output": "clone_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_30", + "inputs": [ + "clone_7" + ], + "output": "view_30", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_31", + "inputs": [ + "view_26" + ], + "output": "view_31", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_64", + "inputs": [ + "view_30", + "p_model_model_language_model_layers_4_linear_attn_norm_weight" + ], + "output": "mul_64", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_65", + "inputs": [ + "view_31", + "mul_64" + ], + "output": "mul_65", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_32", + "inputs": [ + "mul_65" + ], + "output": "view_32", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_35", + "inputs": [ + "view_32", + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight" + ], + "output": "linear_35", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_49", + "inputs": [ + "add_42", + "linear_35" + ], + "output": "add_49", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_67", + "inputs": [ + "add_49", + "p_model_model_language_model_layers_4_post_attention_layernorm_weight" + ], + "output": "mul_67", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_11", + "inputs": [ + "mul_67" + ], + "output": "type_as_11", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_36", + "inputs": [ + "type_as_11", + "p_model_model_language_model_layers_4_mlp_gate_proj_weight" + ], + "output": "linear_36", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_37", + "inputs": [ + "type_as_11", + "p_model_model_language_model_layers_4_mlp_up_proj_weight" + ], + "output": "linear_37", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_68", + "inputs": [ + "linear_36", + "linear_37" + ], + "output": "mul_68", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_38", + "inputs": [ + "mul_68", + "p_model_model_language_model_layers_4_mlp_down_proj_weight" + ], + "output": "linear_38", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_52", + "inputs": [ + "add_49", + "linear_38" + ], + "output": "add_52", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_70", + "inputs": [ + "add_52", + "p_model_model_language_model_layers_5_input_layernorm_weight" + ], + "output": "mul_70", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_12", + "inputs": [ + "mul_70" + ], + "output": "type_as_12", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_39", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_39", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_30", + "inputs": [ + "linear_39" + ], + "output": "transpose_30", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_40", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight" + ], + "output": "linear_40", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_33", + "inputs": [ + "linear_40" + ], + "output": "view_33", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_41", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight" + ], + "output": "linear_41", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_42", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight" + ], + "output": "linear_42", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_9", + "inputs": [ + "states_10", + "transpose_30" + ], + "output": "cat_9", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_52", + "inputs": [ + "cat_9" + ], + "output": "slice_52", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_10", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_4", + "inputs": [ + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight" + ], + "output": "squeeze_4", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_12", + "inputs": [ + "squeeze_4" + ], + "output": "unsqueeze_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_4", + "inputs": [ + "cat_9", + "unsqueeze_12" + ], + "output": "conv1d_4", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_53", + "inputs": [ + "conv1d_4" + ], + "output": "slice_53", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_13", + "inputs": [ + "slice_53" + ], + "output": "silu_13", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_54", + "inputs": [ + "silu_13" + ], + "output": "slice_54", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_31", + "inputs": [ + "slice_54" + ], + "output": "transpose_31", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_55", + "inputs": [ + "transpose_31" + ], + "output": "slice_55", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_56", + "inputs": [ + "transpose_31" + ], + "output": "slice_56", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_57", + "inputs": [ + "transpose_31" + ], + "output": "slice_57", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_34", + "inputs": [ + "slice_55" + ], + "output": "view_34", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_35", + "inputs": [ + "slice_56" + ], + "output": "view_35", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_36", + "inputs": [ + "slice_57" + ], + "output": "view_36", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_5", + "inputs": [ + "linear_41" + ], + "output": "sigmoid_5", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_4", + "inputs": [ + "p_model_model_language_model_layers_5_linear_attn_a_log" + ], + "output": "exp_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_6", + "inputs": [ + "exp_4" + ], + "output": "neg_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_55", + "inputs": [ + "linear_42", + "p_model_model_language_model_layers_5_linear_attn_dt_bias" + ], + "output": "add_55", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_4", + "inputs": [ + "add_55" + ], + "output": "softplus_4", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_71", + "inputs": [ + "neg_6", + "softplus_4" + ], + "output": "mul_71", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_72", + "inputs": [ + "view_34" + ], + "output": "mul_72", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_9", + "inputs": [ + "mul_72" + ], + "output": "sum_9", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_56", + "inputs": [ + "sum_9" + ], + "output": "add_56", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_25", + "inputs": [ + "add_56" + ], + "output": "rsqrt_25", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_73", + "inputs": [ + "view_34", + "rsqrt_25" + ], + "output": "mul_73", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_74", + "inputs": [ + "view_35" + ], + "output": "mul_74", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_10", + "inputs": [ + "mul_74" + ], + "output": "sum_10", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_57", + "inputs": [ + "sum_10" + ], + "output": "add_57", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_26", + "inputs": [ + "add_57" + ], + "output": "rsqrt_26", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_75", + "inputs": [ + "view_35", + "rsqrt_26" + ], + "output": "mul_75", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_4", + "inputs": [ + "mul_73", + "mul_75", + "view_36", + "mul_71", + "sigmoid_5", + "states_11" + ], + "output": "normalized_gated_delta_rule_4", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_58", + "inputs": [ + "normalized_gated_delta_rule_4" + ], + "output": "slice_58", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_11", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_59", + "inputs": [ + "normalized_gated_delta_rule_4" + ], + "output": "slice_59", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_32", + "inputs": [ + "slice_59" + ], + "output": "transpose_32", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_8", + "inputs": [ + "transpose_32" + ], + "output": "clone_8", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_37", + "inputs": [ + "clone_8" + ], + "output": "view_37", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_38", + "inputs": [ + "view_33" + ], + "output": "view_38", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_77", + "inputs": [ + "view_37", + "p_model_model_language_model_layers_5_linear_attn_norm_weight" + ], + "output": "mul_77", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_78", + "inputs": [ + "view_38", + "mul_77" + ], + "output": "mul_78", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_39", + "inputs": [ + "mul_78" + ], + "output": "view_39", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_43", + "inputs": [ + "view_39", + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight" + ], + "output": "linear_43", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_59", + "inputs": [ + "add_52", + "linear_43" + ], + "output": "add_59", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_80", + "inputs": [ + "add_59", + "p_model_model_language_model_layers_5_post_attention_layernorm_weight" + ], + "output": "mul_80", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_13", + "inputs": [ + "mul_80" + ], + "output": "type_as_13", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_44", + "inputs": [ + "type_as_13", + "p_model_model_language_model_layers_5_mlp_gate_proj_weight" + ], + "output": "linear_44", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_45", + "inputs": [ + "type_as_13", + "p_model_model_language_model_layers_5_mlp_up_proj_weight" + ], + "output": "linear_45", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_81", + "inputs": [ + "linear_44", + "linear_45" + ], + "output": "mul_81", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_46", + "inputs": [ + "mul_81", + "p_model_model_language_model_layers_5_mlp_down_proj_weight" + ], + "output": "linear_46", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_62", + "inputs": [ + "add_59", + "linear_46" + ], + "output": "add_62", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_83", + "inputs": [ + "add_62", + "p_model_model_language_model_layers_6_input_layernorm_weight" + ], + "output": "mul_83", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_14", + "inputs": [ + "mul_83" + ], + "output": "type_as_14", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_47", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_47", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_33", + "inputs": [ + "linear_47" + ], + "output": "transpose_33", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_48", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight" + ], + "output": "linear_48", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_40", + "inputs": [ + "linear_48" + ], + "output": "view_40", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_49", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight" + ], + "output": "linear_49", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_50", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight" + ], + "output": "linear_50", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_10", + "inputs": [ + "states_12", + "transpose_33" + ], + "output": "cat_10", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_60", + "inputs": [ + "cat_10" + ], + "output": "slice_60", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_12", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_5", + "inputs": [ + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight" + ], + "output": "squeeze_5", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_13", + "inputs": [ + "squeeze_5" + ], + "output": "unsqueeze_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_5", + "inputs": [ + "cat_10", + "unsqueeze_13" + ], + "output": "conv1d_5", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_61", + "inputs": [ + "conv1d_5" + ], + "output": "slice_61", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_16", + "inputs": [ + "slice_61" + ], + "output": "silu_16", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_62", + "inputs": [ + "silu_16" + ], + "output": "slice_62", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_34", + "inputs": [ + "slice_62" + ], + "output": "transpose_34", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_63", + "inputs": [ + "transpose_34" + ], + "output": "slice_63", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_64", + "inputs": [ + "transpose_34" + ], + "output": "slice_64", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_65", + "inputs": [ + "transpose_34" + ], + "output": "slice_65", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_41", + "inputs": [ + "slice_63" + ], + "output": "view_41", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_42", + "inputs": [ + "slice_64" + ], + "output": "view_42", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_43", + "inputs": [ + "slice_65" + ], + "output": "view_43", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_6", + "inputs": [ + "linear_49" + ], + "output": "sigmoid_6", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_5", + "inputs": [ + "p_model_model_language_model_layers_6_linear_attn_a_log" + ], + "output": "exp_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_7", + "inputs": [ + "exp_5" + ], + "output": "neg_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_65", + "inputs": [ + "linear_50", + "p_model_model_language_model_layers_6_linear_attn_dt_bias" + ], + "output": "add_65", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_5", + "inputs": [ + "add_65" + ], + "output": "softplus_5", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_84", + "inputs": [ + "neg_7", + "softplus_5" + ], + "output": "mul_84", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_85", + "inputs": [ + "view_41" + ], + "output": "mul_85", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_11", + "inputs": [ + "mul_85" + ], + "output": "sum_11", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_66", + "inputs": [ + "sum_11" + ], + "output": "add_66", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_30", + "inputs": [ + "add_66" + ], + "output": "rsqrt_30", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_86", + "inputs": [ + "view_41", + "rsqrt_30" + ], + "output": "mul_86", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_87", + "inputs": [ + "view_42" + ], + "output": "mul_87", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_12", + "inputs": [ + "mul_87" + ], + "output": "sum_12", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_67", + "inputs": [ + "sum_12" + ], + "output": "add_67", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_31", + "inputs": [ + "add_67" + ], + "output": "rsqrt_31", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_88", + "inputs": [ + "view_42", + "rsqrt_31" + ], + "output": "mul_88", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_5", + "inputs": [ + "mul_86", + "mul_88", + "view_43", + "mul_84", + "sigmoid_6", + "states_13" + ], + "output": "normalized_gated_delta_rule_5", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_66", + "inputs": [ + "normalized_gated_delta_rule_5" + ], + "output": "slice_66", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_13", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_67", + "inputs": [ + "normalized_gated_delta_rule_5" + ], + "output": "slice_67", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_35", + "inputs": [ + "slice_67" + ], + "output": "transpose_35", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_9", + "inputs": [ + "transpose_35" + ], + "output": "clone_9", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_44", + "inputs": [ + "clone_9" + ], + "output": "view_44", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_45", + "inputs": [ + "view_40" + ], + "output": "view_45", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_90", + "inputs": [ + "view_44", + "p_model_model_language_model_layers_6_linear_attn_norm_weight" + ], + "output": "mul_90", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_91", + "inputs": [ + "view_45", + "mul_90" + ], + "output": "mul_91", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_46", + "inputs": [ + "mul_91" + ], + "output": "view_46", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_51", + "inputs": [ + "view_46", + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight" + ], + "output": "linear_51", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_69", + "inputs": [ + "add_62", + "linear_51" + ], + "output": "add_69", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_93", + "inputs": [ + "add_69", + "p_model_model_language_model_layers_6_post_attention_layernorm_weight" + ], + "output": "mul_93", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_15", + "inputs": [ + "mul_93" + ], + "output": "type_as_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_52", + "inputs": [ + "type_as_15", + "p_model_model_language_model_layers_6_mlp_gate_proj_weight" + ], + "output": "linear_52", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_53", + "inputs": [ + "type_as_15", + "p_model_model_language_model_layers_6_mlp_up_proj_weight" + ], + "output": "linear_53", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_94", + "inputs": [ + "linear_52", + "linear_53" + ], + "output": "mul_94", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_54", + "inputs": [ + "mul_94", + "p_model_model_language_model_layers_6_mlp_down_proj_weight" + ], + "output": "linear_54", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_72", + "inputs": [ + "add_69", + "linear_54" + ], + "output": "add_72", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_96", + "inputs": [ + "add_72", + "p_model_model_language_model_layers_7_input_layernorm_weight" + ], + "output": "mul_96", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_16", + "inputs": [ + "mul_96" + ], + "output": "type_as_16", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_55", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_q_proj_weight" + ], + "output": "linear_55", + "workgroups": [ + 512, + 2, + 1 + ], + "kernel": "kernels/4e0fada2b6f07e141f088694ab936356f2c70b66fb98e95e537c2c9d7ffb518a.wgsl" + }, + { + "node": "view_47", + "inputs": [ + "linear_55" + ], + "output": "view_47", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl" + }, + { + "node": "slice_68", + "inputs": [ + "view_47" + ], + "output": "slice_68", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl" + }, + { + "node": "slice_69", + "inputs": [ + "view_47" + ], + "output": "slice_69", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl" + }, + { + "node": "clone_10", + "inputs": [ + "slice_69" + ], + "output": "clone_10", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "_unsafe_view_3", + "inputs": [ + "clone_10" + ], + "output": "_unsafe_view_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_48", + "inputs": [ + "slice_68" + ], + "output": "view_48", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_98", + "inputs": [ + "view_48", + "p_model_model_language_model_layers_7_self_attn_q_norm_weight" + ], + "output": "mul_98", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_17", + "inputs": [ + "mul_98" + ], + "output": "type_as_17", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_36", + "inputs": [ + "type_as_17" + ], + "output": "transpose_36", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl" + }, + { + "node": "linear_56", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_k_proj_weight" + ], + "output": "linear_56", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_49", + "inputs": [ + "linear_56" + ], + "output": "view_49", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_100", + "inputs": [ + "view_49", + "p_model_model_language_model_layers_7_self_attn_k_norm_weight" + ], + "output": "mul_100", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_18", + "inputs": [ + "mul_100" + ], + "output": "type_as_18", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_37", + "inputs": [ + "type_as_18" + ], + "output": "transpose_37", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "linear_57", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_v_proj_weight" + ], + "output": "linear_57", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_50", + "inputs": [ + "linear_57" + ], + "output": "view_50", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_38", + "inputs": [ + "view_50" + ], + "output": "transpose_38", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "unsqueeze_14", + "inputs": [ + "mul" + ], + "output": "unsqueeze_14", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "unsqueeze_15", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_15", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "slice_70", + "inputs": [ + "transpose_36" + ], + "output": "slice_70", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl" + }, + { + "node": "slice_71", + "inputs": [ + "transpose_36" + ], + "output": "slice_71", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl" + }, + { + "node": "slice_72", + "inputs": [ + "transpose_37" + ], + "output": "slice_72", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl" + }, + { + "node": "slice_73", + "inputs": [ + "transpose_37" + ], + "output": "slice_73", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl" + }, + { + "node": "mul_101", + "inputs": [ + "slice_70", + "unsqueeze_14" + ], + "output": "mul_101", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "slice_74", + "inputs": [ + "slice_70" + ], + "output": "slice_74", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl" + }, + { + "node": "slice_75", + "inputs": [ + "slice_70" + ], + "output": "slice_75", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl" + }, + { + "node": "neg_8", + "inputs": [ + "slice_75" + ], + "output": "neg_8", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_11", + "inputs": [ + "neg_8", + "slice_74" + ], + "output": "cat_11", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_102", + "inputs": [ + "cat_11", + "unsqueeze_15" + ], + "output": "mul_102", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "add_79", + "inputs": [ + "mul_101", + "mul_102" + ], + "output": "add_79", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_103", + "inputs": [ + "slice_72", + "unsqueeze_14" + ], + "output": "mul_103", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "slice_76", + "inputs": [ + "slice_72" + ], + "output": "slice_76", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl" + }, + { + "node": "slice_77", + "inputs": [ + "slice_72" + ], + "output": "slice_77", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl" + }, + { + "node": "neg_9", + "inputs": [ + "slice_77" + ], + "output": "neg_9", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_12", + "inputs": [ + "neg_9", + "slice_76" + ], + "output": "cat_12", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_104", + "inputs": [ + "cat_12", + "unsqueeze_15" + ], + "output": "mul_104", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "add_80", + "inputs": [ + "mul_103", + "mul_104" + ], + "output": "add_80", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "cat_13", + "inputs": [ + "add_79", + "slice_71" + ], + "output": "cat_13", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cat_14", + "inputs": [ + "add_80", + "slice_73" + ], + "output": "cat_14", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cache_update_2", + "inputs": [ + "cat_14", + "cache_position" + ], + "output": "cache_update_2", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_14", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "cache_update_3", + "inputs": [ + "transpose_38", + "cache_position" + ], + "output": "cache_update_3", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_15", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "unsqueeze_16", + "inputs": [ + "cache_update_2" + ], + "output": "unsqueeze_16", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_3", + "inputs": [ + "unsqueeze_16" + ], + "output": "expand_3", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_11", + "inputs": [ + "expand_3" + ], + "output": "clone_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_4", + "inputs": [ + "clone_11" + ], + "output": "_unsafe_view_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_17", + "inputs": [ + "cache_update_3" + ], + "output": "unsqueeze_17", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_4", + "inputs": [ + "unsqueeze_17" + ], + "output": "expand_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_12", + "inputs": [ + "expand_4" + ], + "output": "clone_12", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_5", + "inputs": [ + "clone_12" + ], + "output": "_unsafe_view_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_39", + "inputs": [ + "_unsafe_view_4" + ], + "output": "transpose_39", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_3", + "inputs": [ + "cat_13", + "transpose_39" + ], + "output": "matmul_3", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl" + }, + { + "node": "mul_105", + "inputs": [ + "matmul_3" + ], + "output": "mul_105", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl" + }, + { + "node": "add_81", + "inputs": [ + "mul_105", + "attention_mask" + ], + "output": "add_81", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl" + }, + { + "node": "softmax_1", + "inputs": [ + "add_81" + ], + "output": "softmax_1", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl" + }, + { + "node": "matmul_4", + "inputs": [ + "softmax_1", + "_unsafe_view_5" + ], + "output": "matmul_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl" + }, + { + "node": "transpose_40", + "inputs": [ + "matmul_4" + ], + "output": "transpose_40", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl" + }, + { + "node": "clone_13", + "inputs": [ + "transpose_40" + ], + "output": "clone_13", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_51", + "inputs": [ + "clone_13" + ], + "output": "view_51", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_7", + "inputs": [ + "_unsafe_view_3" + ], + "output": "sigmoid_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl" + }, + { + "node": "mul_106", + "inputs": [ + "view_51", + "sigmoid_7" + ], + "output": "mul_106", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl" + }, + { + "node": "linear_58", + "inputs": [ + "mul_106", + "p_model_model_language_model_layers_7_self_attn_o_proj_weight" + ], + "output": "linear_58", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_82", + "inputs": [ + "add_72", + "linear_58" + ], + "output": "add_82", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_108", + "inputs": [ + "add_82", + "p_model_model_language_model_layers_7_post_attention_layernorm_weight" + ], + "output": "mul_108", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_19", + "inputs": [ + "mul_108" + ], + "output": "type_as_19", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_59", + "inputs": [ + "type_as_19", + "p_model_model_language_model_layers_7_mlp_gate_proj_weight" + ], + "output": "linear_59", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_60", + "inputs": [ + "type_as_19", + "p_model_model_language_model_layers_7_mlp_up_proj_weight" + ], + "output": "linear_60", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_109", + "inputs": [ + "linear_59", + "linear_60" + ], + "output": "mul_109", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_61", + "inputs": [ + "mul_109", + "p_model_model_language_model_layers_7_mlp_down_proj_weight" + ], + "output": "linear_61", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_85", + "inputs": [ + "add_82", + "linear_61" + ], + "output": "add_85", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_111", + "inputs": [ + "add_85", + "p_model_model_language_model_layers_8_input_layernorm_weight" + ], + "output": "mul_111", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_20", + "inputs": [ + "mul_111" + ], + "output": "type_as_20", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_62", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_62", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_41", + "inputs": [ + "linear_62" + ], + "output": "transpose_41", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_63", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight" + ], + "output": "linear_63", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_52", + "inputs": [ + "linear_63" + ], + "output": "view_52", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_64", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight" + ], + "output": "linear_64", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_65", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight" + ], + "output": "linear_65", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_15", + "inputs": [ + "states_16", + "transpose_41" + ], + "output": "cat_15", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_78", + "inputs": [ + "cat_15" + ], + "output": "slice_78", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_16", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_6", + "inputs": [ + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight" + ], + "output": "squeeze_6", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_18", + "inputs": [ + "squeeze_6" + ], + "output": "unsqueeze_18", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_6", + "inputs": [ + "cat_15", + "unsqueeze_18" + ], + "output": "conv1d_6", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_79", + "inputs": [ + "conv1d_6" + ], + "output": "slice_79", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_20", + "inputs": [ + "slice_79" + ], + "output": "silu_20", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_80", + "inputs": [ + "silu_20" + ], + "output": "slice_80", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_42", + "inputs": [ + "slice_80" + ], + "output": "transpose_42", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_81", + "inputs": [ + "transpose_42" + ], + "output": "slice_81", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_82", + "inputs": [ + "transpose_42" + ], + "output": "slice_82", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_83", + "inputs": [ + "transpose_42" + ], + "output": "slice_83", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_53", + "inputs": [ + "slice_81" + ], + "output": "view_53", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_54", + "inputs": [ + "slice_82" + ], + "output": "view_54", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_55", + "inputs": [ + "slice_83" + ], + "output": "view_55", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_8", + "inputs": [ + "linear_64" + ], + "output": "sigmoid_8", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_6", + "inputs": [ + "p_model_model_language_model_layers_8_linear_attn_a_log" + ], + "output": "exp_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_10", + "inputs": [ + "exp_6" + ], + "output": "neg_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_88", + "inputs": [ + "linear_65", + "p_model_model_language_model_layers_8_linear_attn_dt_bias" + ], + "output": "add_88", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_6", + "inputs": [ + "add_88" + ], + "output": "softplus_6", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_112", + "inputs": [ + "neg_10", + "softplus_6" + ], + "output": "mul_112", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_113", + "inputs": [ + "view_53" + ], + "output": "mul_113", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_13", + "inputs": [ + "mul_113" + ], + "output": "sum_13", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_89", + "inputs": [ + "sum_13" + ], + "output": "add_89", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_39", + "inputs": [ + "add_89" + ], + "output": "rsqrt_39", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_114", + "inputs": [ + "view_53", + "rsqrt_39" + ], + "output": "mul_114", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_115", + "inputs": [ + "view_54" + ], + "output": "mul_115", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_14", + "inputs": [ + "mul_115" + ], + "output": "sum_14", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_90", + "inputs": [ + "sum_14" + ], + "output": "add_90", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_40", + "inputs": [ + "add_90" + ], + "output": "rsqrt_40", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_116", + "inputs": [ + "view_54", + "rsqrt_40" + ], + "output": "mul_116", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_6", + "inputs": [ + "mul_114", + "mul_116", + "view_55", + "mul_112", + "sigmoid_8", + "states_17" + ], + "output": "normalized_gated_delta_rule_6", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_84", + "inputs": [ + "normalized_gated_delta_rule_6" + ], + "output": "slice_84", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_17", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_85", + "inputs": [ + "normalized_gated_delta_rule_6" + ], + "output": "slice_85", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_43", + "inputs": [ + "slice_85" + ], + "output": "transpose_43", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_14", + "inputs": [ + "transpose_43" + ], + "output": "clone_14", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_56", + "inputs": [ + "clone_14" + ], + "output": "view_56", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_57", + "inputs": [ + "view_52" + ], + "output": "view_57", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_118", + "inputs": [ + "view_56", + "p_model_model_language_model_layers_8_linear_attn_norm_weight" + ], + "output": "mul_118", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_119", + "inputs": [ + "view_57", + "mul_118" + ], + "output": "mul_119", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_58", + "inputs": [ + "mul_119" + ], + "output": "view_58", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_66", + "inputs": [ + "view_58", + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight" + ], + "output": "linear_66", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_92", + "inputs": [ + "add_85", + "linear_66" + ], + "output": "add_92", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_121", + "inputs": [ + "add_92", + "p_model_model_language_model_layers_8_post_attention_layernorm_weight" + ], + "output": "mul_121", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_21", + "inputs": [ + "mul_121" + ], + "output": "type_as_21", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_67", + "inputs": [ + "type_as_21", + "p_model_model_language_model_layers_8_mlp_gate_proj_weight" + ], + "output": "linear_67", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_68", + "inputs": [ + "type_as_21", + "p_model_model_language_model_layers_8_mlp_up_proj_weight" + ], + "output": "linear_68", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_122", + "inputs": [ + "linear_67", + "linear_68" + ], + "output": "mul_122", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_69", + "inputs": [ + "mul_122", + "p_model_model_language_model_layers_8_mlp_down_proj_weight" + ], + "output": "linear_69", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_95", + "inputs": [ + "add_92", + "linear_69" + ], + "output": "add_95", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_124", + "inputs": [ + "add_95", + "p_model_model_language_model_layers_9_input_layernorm_weight" + ], + "output": "mul_124", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_22", + "inputs": [ + "mul_124" + ], + "output": "type_as_22", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_70", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_70", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_44", + "inputs": [ + "linear_70" + ], + "output": "transpose_44", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_71", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight" + ], + "output": "linear_71", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_59", + "inputs": [ + "linear_71" + ], + "output": "view_59", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_72", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight" + ], + "output": "linear_72", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_73", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight" + ], + "output": "linear_73", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_16", + "inputs": [ + "states_18", + "transpose_44" + ], + "output": "cat_16", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_86", + "inputs": [ + "cat_16" + ], + "output": "slice_86", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_18", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_7", + "inputs": [ + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight" + ], + "output": "squeeze_7", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_19", + "inputs": [ + "squeeze_7" + ], + "output": "unsqueeze_19", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_7", + "inputs": [ + "cat_16", + "unsqueeze_19" + ], + "output": "conv1d_7", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_87", + "inputs": [ + "conv1d_7" + ], + "output": "slice_87", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_23", + "inputs": [ + "slice_87" + ], + "output": "silu_23", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_88", + "inputs": [ + "silu_23" + ], + "output": "slice_88", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_45", + "inputs": [ + "slice_88" + ], + "output": "transpose_45", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_89", + "inputs": [ + "transpose_45" + ], + "output": "slice_89", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_90", + "inputs": [ + "transpose_45" + ], + "output": "slice_90", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_91", + "inputs": [ + "transpose_45" + ], + "output": "slice_91", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_60", + "inputs": [ + "slice_89" + ], + "output": "view_60", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_61", + "inputs": [ + "slice_90" + ], + "output": "view_61", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_62", + "inputs": [ + "slice_91" + ], + "output": "view_62", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_9", + "inputs": [ + "linear_72" + ], + "output": "sigmoid_9", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_7", + "inputs": [ + "p_model_model_language_model_layers_9_linear_attn_a_log" + ], + "output": "exp_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_11", + "inputs": [ + "exp_7" + ], + "output": "neg_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_98", + "inputs": [ + "linear_73", + "p_model_model_language_model_layers_9_linear_attn_dt_bias" + ], + "output": "add_98", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_7", + "inputs": [ + "add_98" + ], + "output": "softplus_7", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_125", + "inputs": [ + "neg_11", + "softplus_7" + ], + "output": "mul_125", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_126", + "inputs": [ + "view_60" + ], + "output": "mul_126", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_15", + "inputs": [ + "mul_126" + ], + "output": "sum_15", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_99", + "inputs": [ + "sum_15" + ], + "output": "add_99", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_44", + "inputs": [ + "add_99" + ], + "output": "rsqrt_44", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_127", + "inputs": [ + "view_60", + "rsqrt_44" + ], + "output": "mul_127", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_128", + "inputs": [ + "view_61" + ], + "output": "mul_128", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_16", + "inputs": [ + "mul_128" + ], + "output": "sum_16", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_100", + "inputs": [ + "sum_16" + ], + "output": "add_100", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_45", + "inputs": [ + "add_100" + ], + "output": "rsqrt_45", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_129", + "inputs": [ + "view_61", + "rsqrt_45" + ], + "output": "mul_129", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_7", + "inputs": [ + "mul_127", + "mul_129", + "view_62", + "mul_125", + "sigmoid_9", + "states_19" + ], + "output": "normalized_gated_delta_rule_7", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_92", + "inputs": [ + "normalized_gated_delta_rule_7" + ], + "output": "slice_92", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_19", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_93", + "inputs": [ + "normalized_gated_delta_rule_7" + ], + "output": "slice_93", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_46", + "inputs": [ + "slice_93" + ], + "output": "transpose_46", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_15", + "inputs": [ + "transpose_46" + ], + "output": "clone_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_63", + "inputs": [ + "clone_15" + ], + "output": "view_63", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_64", + "inputs": [ + "view_59" + ], + "output": "view_64", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_131", + "inputs": [ + "view_63", + "p_model_model_language_model_layers_9_linear_attn_norm_weight" + ], + "output": "mul_131", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_132", + "inputs": [ + "view_64", + "mul_131" + ], + "output": "mul_132", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_65", + "inputs": [ + "mul_132" + ], + "output": "view_65", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_74", + "inputs": [ + "view_65", + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight" + ], + "output": "linear_74", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_102", + "inputs": [ + "add_95", + "linear_74" + ], + "output": "add_102", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_134", + "inputs": [ + "add_102", + "p_model_model_language_model_layers_9_post_attention_layernorm_weight" + ], + "output": "mul_134", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_23", + "inputs": [ + "mul_134" + ], + "output": "type_as_23", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_75", + "inputs": [ + "type_as_23", + "p_model_model_language_model_layers_9_mlp_gate_proj_weight" + ], + "output": "linear_75", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_76", + "inputs": [ + "type_as_23", + "p_model_model_language_model_layers_9_mlp_up_proj_weight" + ], + "output": "linear_76", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_135", + "inputs": [ + "linear_75", + "linear_76" + ], + "output": "mul_135", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_77", + "inputs": [ + "mul_135", + "p_model_model_language_model_layers_9_mlp_down_proj_weight" + ], + "output": "linear_77", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_105", + "inputs": [ + "add_102", + "linear_77" + ], + "output": "add_105", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_137", + "inputs": [ + "add_105", + "p_model_model_language_model_layers_10_input_layernorm_weight" + ], + "output": "mul_137", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_24", + "inputs": [ + "mul_137" + ], + "output": "type_as_24", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_78", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_78", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_47", + "inputs": [ + "linear_78" + ], + "output": "transpose_47", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_79", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight" + ], + "output": "linear_79", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_66", + "inputs": [ + "linear_79" + ], + "output": "view_66", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_80", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight" + ], + "output": "linear_80", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_81", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight" + ], + "output": "linear_81", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_17", + "inputs": [ + "states_20", + "transpose_47" + ], + "output": "cat_17", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_94", + "inputs": [ + "cat_17" + ], + "output": "slice_94", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_20", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_8", + "inputs": [ + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight" + ], + "output": "squeeze_8", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_20", + "inputs": [ + "squeeze_8" + ], + "output": "unsqueeze_20", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_8", + "inputs": [ + "cat_17", + "unsqueeze_20" + ], + "output": "conv1d_8", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_95", + "inputs": [ + "conv1d_8" + ], + "output": "slice_95", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_26", + "inputs": [ + "slice_95" + ], + "output": "silu_26", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_96", + "inputs": [ + "silu_26" + ], + "output": "slice_96", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_48", + "inputs": [ + "slice_96" + ], + "output": "transpose_48", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_97", + "inputs": [ + "transpose_48" + ], + "output": "slice_97", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_98", + "inputs": [ + "transpose_48" + ], + "output": "slice_98", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_99", + "inputs": [ + "transpose_48" + ], + "output": "slice_99", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_67", + "inputs": [ + "slice_97" + ], + "output": "view_67", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_68", + "inputs": [ + "slice_98" + ], + "output": "view_68", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_69", + "inputs": [ + "slice_99" + ], + "output": "view_69", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_10", + "inputs": [ + "linear_80" + ], + "output": "sigmoid_10", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_8", + "inputs": [ + "p_model_model_language_model_layers_10_linear_attn_a_log" + ], + "output": "exp_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_12", + "inputs": [ + "exp_8" + ], + "output": "neg_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_108", + "inputs": [ + "linear_81", + "p_model_model_language_model_layers_10_linear_attn_dt_bias" + ], + "output": "add_108", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_8", + "inputs": [ + "add_108" + ], + "output": "softplus_8", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_138", + "inputs": [ + "neg_12", + "softplus_8" + ], + "output": "mul_138", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_139", + "inputs": [ + "view_67" + ], + "output": "mul_139", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_17", + "inputs": [ + "mul_139" + ], + "output": "sum_17", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_109", + "inputs": [ + "sum_17" + ], + "output": "add_109", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_49", + "inputs": [ + "add_109" + ], + "output": "rsqrt_49", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_140", + "inputs": [ + "view_67", + "rsqrt_49" + ], + "output": "mul_140", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_141", + "inputs": [ + "view_68" + ], + "output": "mul_141", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_18", + "inputs": [ + "mul_141" + ], + "output": "sum_18", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_110", + "inputs": [ + "sum_18" + ], + "output": "add_110", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_50", + "inputs": [ + "add_110" + ], + "output": "rsqrt_50", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_142", + "inputs": [ + "view_68", + "rsqrt_50" + ], + "output": "mul_142", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_8", + "inputs": [ + "mul_140", + "mul_142", + "view_69", + "mul_138", + "sigmoid_10", + "states_21" + ], + "output": "normalized_gated_delta_rule_8", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_100", + "inputs": [ + "normalized_gated_delta_rule_8" + ], + "output": "slice_100", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_21", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_101", + "inputs": [ + "normalized_gated_delta_rule_8" + ], + "output": "slice_101", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_49", + "inputs": [ + "slice_101" + ], + "output": "transpose_49", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_16", + "inputs": [ + "transpose_49" + ], + "output": "clone_16", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_70", + "inputs": [ + "clone_16" + ], + "output": "view_70", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_71", + "inputs": [ + "view_66" + ], + "output": "view_71", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_144", + "inputs": [ + "view_70", + "p_model_model_language_model_layers_10_linear_attn_norm_weight" + ], + "output": "mul_144", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_145", + "inputs": [ + "view_71", + "mul_144" + ], + "output": "mul_145", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_72", + "inputs": [ + "mul_145" + ], + "output": "view_72", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_82", + "inputs": [ + "view_72", + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight" + ], + "output": "linear_82", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_112", + "inputs": [ + "add_105", + "linear_82" + ], + "output": "add_112", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_147", + "inputs": [ + "add_112", + "p_model_model_language_model_layers_10_post_attention_layernorm_weight" + ], + "output": "mul_147", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_25", + "inputs": [ + "mul_147" + ], + "output": "type_as_25", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_83", + "inputs": [ + "type_as_25", + "p_model_model_language_model_layers_10_mlp_gate_proj_weight" + ], + "output": "linear_83", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_84", + "inputs": [ + "type_as_25", + "p_model_model_language_model_layers_10_mlp_up_proj_weight" + ], + "output": "linear_84", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_148", + "inputs": [ + "linear_83", + "linear_84" + ], + "output": "mul_148", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_85", + "inputs": [ + "mul_148", + "p_model_model_language_model_layers_10_mlp_down_proj_weight" + ], + "output": "linear_85", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_115", + "inputs": [ + "add_112", + "linear_85" + ], + "output": "add_115", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_150", + "inputs": [ + "add_115", + "p_model_model_language_model_layers_11_input_layernorm_weight" + ], + "output": "mul_150", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_26", + "inputs": [ + "mul_150" + ], + "output": "type_as_26", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_86", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_q_proj_weight" + ], + "output": "linear_86", + "workgroups": [ + 512, + 2, + 1 + ], + "kernel": "kernels/4e0fada2b6f07e141f088694ab936356f2c70b66fb98e95e537c2c9d7ffb518a.wgsl" + }, + { + "node": "view_73", + "inputs": [ + "linear_86" + ], + "output": "view_73", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl" + }, + { + "node": "slice_102", + "inputs": [ + "view_73" + ], + "output": "slice_102", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl" + }, + { + "node": "slice_103", + "inputs": [ + "view_73" + ], + "output": "slice_103", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl" + }, + { + "node": "clone_17", + "inputs": [ + "slice_103" + ], + "output": "clone_17", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "_unsafe_view_6", + "inputs": [ + "clone_17" + ], + "output": "_unsafe_view_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_74", + "inputs": [ + "slice_102" + ], + "output": "view_74", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_152", + "inputs": [ + "view_74", + "p_model_model_language_model_layers_11_self_attn_q_norm_weight" + ], + "output": "mul_152", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_27", + "inputs": [ + "mul_152" + ], + "output": "type_as_27", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_50", + "inputs": [ + "type_as_27" + ], + "output": "transpose_50", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl" + }, + { + "node": "linear_87", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_k_proj_weight" + ], + "output": "linear_87", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_75", + "inputs": [ + "linear_87" + ], + "output": "view_75", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_154", + "inputs": [ + "view_75", + "p_model_model_language_model_layers_11_self_attn_k_norm_weight" + ], + "output": "mul_154", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_28", + "inputs": [ + "mul_154" + ], + "output": "type_as_28", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_51", + "inputs": [ + "type_as_28" + ], + "output": "transpose_51", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "linear_88", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_v_proj_weight" + ], + "output": "linear_88", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_76", + "inputs": [ + "linear_88" + ], + "output": "view_76", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_52", + "inputs": [ + "view_76" + ], + "output": "transpose_52", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "unsqueeze_21", + "inputs": [ + "mul" + ], + "output": "unsqueeze_21", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "unsqueeze_22", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_22", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "slice_104", + "inputs": [ + "transpose_50" + ], + "output": "slice_104", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl" + }, + { + "node": "slice_105", + "inputs": [ + "transpose_50" + ], + "output": "slice_105", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl" + }, + { + "node": "slice_106", + "inputs": [ + "transpose_51" + ], + "output": "slice_106", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl" + }, + { + "node": "slice_107", + "inputs": [ + "transpose_51" + ], + "output": "slice_107", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl" + }, + { + "node": "mul_155", + "inputs": [ + "slice_104", + "unsqueeze_21" + ], + "output": "mul_155", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "slice_108", + "inputs": [ + "slice_104" + ], + "output": "slice_108", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl" + }, + { + "node": "slice_109", + "inputs": [ + "slice_104" + ], + "output": "slice_109", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl" + }, + { + "node": "neg_13", + "inputs": [ + "slice_109" + ], + "output": "neg_13", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_18", + "inputs": [ + "neg_13", + "slice_108" + ], + "output": "cat_18", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_156", + "inputs": [ + "cat_18", + "unsqueeze_22" + ], + "output": "mul_156", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "add_122", + "inputs": [ + "mul_155", + "mul_156" + ], + "output": "add_122", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_157", + "inputs": [ + "slice_106", + "unsqueeze_21" + ], + "output": "mul_157", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "slice_110", + "inputs": [ + "slice_106" + ], + "output": "slice_110", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl" + }, + { + "node": "slice_111", + "inputs": [ + "slice_106" + ], + "output": "slice_111", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl" + }, + { + "node": "neg_14", + "inputs": [ + "slice_111" + ], + "output": "neg_14", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_19", + "inputs": [ + "neg_14", + "slice_110" + ], + "output": "cat_19", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_158", + "inputs": [ + "cat_19", + "unsqueeze_22" + ], + "output": "mul_158", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "add_123", + "inputs": [ + "mul_157", + "mul_158" + ], + "output": "add_123", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "cat_20", + "inputs": [ + "add_122", + "slice_105" + ], + "output": "cat_20", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cat_21", + "inputs": [ + "add_123", + "slice_107" + ], + "output": "cat_21", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cache_update_4", + "inputs": [ + "cat_21", + "cache_position" + ], + "output": "cache_update_4", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_22", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "cache_update_5", + "inputs": [ + "transpose_52", + "cache_position" + ], + "output": "cache_update_5", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_23", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "unsqueeze_23", + "inputs": [ + "cache_update_4" + ], + "output": "unsqueeze_23", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_5", + "inputs": [ + "unsqueeze_23" + ], + "output": "expand_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_18", + "inputs": [ + "expand_5" + ], + "output": "clone_18", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_7", + "inputs": [ + "clone_18" + ], + "output": "_unsafe_view_7", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_24", + "inputs": [ + "cache_update_5" + ], + "output": "unsqueeze_24", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_6", + "inputs": [ + "unsqueeze_24" + ], + "output": "expand_6", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_19", + "inputs": [ + "expand_6" + ], + "output": "clone_19", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_8", + "inputs": [ + "clone_19" + ], + "output": "_unsafe_view_8", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_53", + "inputs": [ + "_unsafe_view_7" + ], + "output": "transpose_53", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_5", + "inputs": [ + "cat_20", + "transpose_53" + ], + "output": "matmul_5", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl" + }, + { + "node": "mul_159", + "inputs": [ + "matmul_5" + ], + "output": "mul_159", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl" + }, + { + "node": "add_124", + "inputs": [ + "mul_159", + "attention_mask" + ], + "output": "add_124", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl" + }, + { + "node": "softmax_2", + "inputs": [ + "add_124" + ], + "output": "softmax_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl" + }, + { + "node": "matmul_6", + "inputs": [ + "softmax_2", + "_unsafe_view_8" + ], + "output": "matmul_6", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl" + }, + { + "node": "transpose_54", + "inputs": [ + "matmul_6" + ], + "output": "transpose_54", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl" + }, + { + "node": "clone_20", + "inputs": [ + "transpose_54" + ], + "output": "clone_20", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_77", + "inputs": [ + "clone_20" + ], + "output": "view_77", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_11", + "inputs": [ + "_unsafe_view_6" + ], + "output": "sigmoid_11", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl" + }, + { + "node": "mul_160", + "inputs": [ + "view_77", + "sigmoid_11" + ], + "output": "mul_160", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl" + }, + { + "node": "linear_89", + "inputs": [ + "mul_160", + "p_model_model_language_model_layers_11_self_attn_o_proj_weight" + ], + "output": "linear_89", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_125", + "inputs": [ + "add_115", + "linear_89" + ], + "output": "add_125", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_162", + "inputs": [ + "add_125", + "p_model_model_language_model_layers_11_post_attention_layernorm_weight" + ], + "output": "mul_162", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_29", + "inputs": [ + "mul_162" + ], + "output": "type_as_29", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_90", + "inputs": [ + "type_as_29", + "p_model_model_language_model_layers_11_mlp_gate_proj_weight" + ], + "output": "linear_90", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_91", + "inputs": [ + "type_as_29", + "p_model_model_language_model_layers_11_mlp_up_proj_weight" + ], + "output": "linear_91", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_163", + "inputs": [ + "linear_90", + "linear_91" + ], + "output": "mul_163", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_92", + "inputs": [ + "mul_163", + "p_model_model_language_model_layers_11_mlp_down_proj_weight" + ], + "output": "linear_92", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_128", + "inputs": [ + "add_125", + "linear_92" + ], + "output": "add_128", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_165", + "inputs": [ + "add_128", + "p_model_model_language_model_layers_12_input_layernorm_weight" + ], + "output": "mul_165", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_30", + "inputs": [ + "mul_165" + ], + "output": "type_as_30", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_93", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_93", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_55", + "inputs": [ + "linear_93" + ], + "output": "transpose_55", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_94", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight" + ], + "output": "linear_94", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_78", + "inputs": [ + "linear_94" + ], + "output": "view_78", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_95", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight" + ], + "output": "linear_95", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_96", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight" + ], + "output": "linear_96", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_22", + "inputs": [ + "states_24", + "transpose_55" + ], + "output": "cat_22", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_112", + "inputs": [ + "cat_22" + ], + "output": "slice_112", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_24", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_9", + "inputs": [ + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight" + ], + "output": "squeeze_9", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_25", + "inputs": [ + "squeeze_9" + ], + "output": "unsqueeze_25", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_9", + "inputs": [ + "cat_22", + "unsqueeze_25" + ], + "output": "conv1d_9", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_113", + "inputs": [ + "conv1d_9" + ], + "output": "slice_113", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_30", + "inputs": [ + "slice_113" + ], + "output": "silu_30", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_114", + "inputs": [ + "silu_30" + ], + "output": "slice_114", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_56", + "inputs": [ + "slice_114" + ], + "output": "transpose_56", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_115", + "inputs": [ + "transpose_56" + ], + "output": "slice_115", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_116", + "inputs": [ + "transpose_56" + ], + "output": "slice_116", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_117", + "inputs": [ + "transpose_56" + ], + "output": "slice_117", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_79", + "inputs": [ + "slice_115" + ], + "output": "view_79", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_80", + "inputs": [ + "slice_116" + ], + "output": "view_80", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_81", + "inputs": [ + "slice_117" + ], + "output": "view_81", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_12", + "inputs": [ + "linear_95" + ], + "output": "sigmoid_12", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_9", + "inputs": [ + "p_model_model_language_model_layers_12_linear_attn_a_log" + ], + "output": "exp_9", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_15", + "inputs": [ + "exp_9" + ], + "output": "neg_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_131", + "inputs": [ + "linear_96", + "p_model_model_language_model_layers_12_linear_attn_dt_bias" + ], + "output": "add_131", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_9", + "inputs": [ + "add_131" + ], + "output": "softplus_9", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_166", + "inputs": [ + "neg_15", + "softplus_9" + ], + "output": "mul_166", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_167", + "inputs": [ + "view_79" + ], + "output": "mul_167", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_19", + "inputs": [ + "mul_167" + ], + "output": "sum_19", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_132", + "inputs": [ + "sum_19" + ], + "output": "add_132", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_58", + "inputs": [ + "add_132" + ], + "output": "rsqrt_58", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_168", + "inputs": [ + "view_79", + "rsqrt_58" + ], + "output": "mul_168", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_169", + "inputs": [ + "view_80" + ], + "output": "mul_169", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_20", + "inputs": [ + "mul_169" + ], + "output": "sum_20", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_133", + "inputs": [ + "sum_20" + ], + "output": "add_133", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_59", + "inputs": [ + "add_133" + ], + "output": "rsqrt_59", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_170", + "inputs": [ + "view_80", + "rsqrt_59" + ], + "output": "mul_170", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_9", + "inputs": [ + "mul_168", + "mul_170", + "view_81", + "mul_166", + "sigmoid_12", + "states_25" + ], + "output": "normalized_gated_delta_rule_9", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_118", + "inputs": [ + "normalized_gated_delta_rule_9" + ], + "output": "slice_118", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_25", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_119", + "inputs": [ + "normalized_gated_delta_rule_9" + ], + "output": "slice_119", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_57", + "inputs": [ + "slice_119" + ], + "output": "transpose_57", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_21", + "inputs": [ + "transpose_57" + ], + "output": "clone_21", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_82", + "inputs": [ + "clone_21" + ], + "output": "view_82", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_83", + "inputs": [ + "view_78" + ], + "output": "view_83", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_172", + "inputs": [ + "view_82", + "p_model_model_language_model_layers_12_linear_attn_norm_weight" + ], + "output": "mul_172", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_173", + "inputs": [ + "view_83", + "mul_172" + ], + "output": "mul_173", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_84", + "inputs": [ + "mul_173" + ], + "output": "view_84", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_97", + "inputs": [ + "view_84", + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight" + ], + "output": "linear_97", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_135", + "inputs": [ + "add_128", + "linear_97" + ], + "output": "add_135", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_175", + "inputs": [ + "add_135", + "p_model_model_language_model_layers_12_post_attention_layernorm_weight" + ], + "output": "mul_175", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_31", + "inputs": [ + "mul_175" + ], + "output": "type_as_31", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_98", + "inputs": [ + "type_as_31", + "p_model_model_language_model_layers_12_mlp_gate_proj_weight" + ], + "output": "linear_98", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_99", + "inputs": [ + "type_as_31", + "p_model_model_language_model_layers_12_mlp_up_proj_weight" + ], + "output": "linear_99", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_176", + "inputs": [ + "linear_98", + "linear_99" + ], + "output": "mul_176", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_100", + "inputs": [ + "mul_176", + "p_model_model_language_model_layers_12_mlp_down_proj_weight" + ], + "output": "linear_100", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_138", + "inputs": [ + "add_135", + "linear_100" + ], + "output": "add_138", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_178", + "inputs": [ + "add_138", + "p_model_model_language_model_layers_13_input_layernorm_weight" + ], + "output": "mul_178", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_32", + "inputs": [ + "mul_178" + ], + "output": "type_as_32", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_101", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_101", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_58", + "inputs": [ + "linear_101" + ], + "output": "transpose_58", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_102", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight" + ], + "output": "linear_102", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_85", + "inputs": [ + "linear_102" + ], + "output": "view_85", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_103", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight" + ], + "output": "linear_103", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_104", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight" + ], + "output": "linear_104", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_23", + "inputs": [ + "states_26", + "transpose_58" + ], + "output": "cat_23", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_120", + "inputs": [ + "cat_23" + ], + "output": "slice_120", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_26", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_10", + "inputs": [ + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight" + ], + "output": "squeeze_10", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_26", + "inputs": [ + "squeeze_10" + ], + "output": "unsqueeze_26", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_10", + "inputs": [ + "cat_23", + "unsqueeze_26" + ], + "output": "conv1d_10", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_121", + "inputs": [ + "conv1d_10" + ], + "output": "slice_121", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_33", + "inputs": [ + "slice_121" + ], + "output": "silu_33", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_122", + "inputs": [ + "silu_33" + ], + "output": "slice_122", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_59", + "inputs": [ + "slice_122" + ], + "output": "transpose_59", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_123", + "inputs": [ + "transpose_59" + ], + "output": "slice_123", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_124", + "inputs": [ + "transpose_59" + ], + "output": "slice_124", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_125", + "inputs": [ + "transpose_59" + ], + "output": "slice_125", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_86", + "inputs": [ + "slice_123" + ], + "output": "view_86", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_87", + "inputs": [ + "slice_124" + ], + "output": "view_87", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_88", + "inputs": [ + "slice_125" + ], + "output": "view_88", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_13", + "inputs": [ + "linear_103" + ], + "output": "sigmoid_13", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_10", + "inputs": [ + "p_model_model_language_model_layers_13_linear_attn_a_log" + ], + "output": "exp_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_16", + "inputs": [ + "exp_10" + ], + "output": "neg_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_141", + "inputs": [ + "linear_104", + "p_model_model_language_model_layers_13_linear_attn_dt_bias" + ], + "output": "add_141", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_10", + "inputs": [ + "add_141" + ], + "output": "softplus_10", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_179", + "inputs": [ + "neg_16", + "softplus_10" + ], + "output": "mul_179", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_180", + "inputs": [ + "view_86" + ], + "output": "mul_180", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_21", + "inputs": [ + "mul_180" + ], + "output": "sum_21", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_142", + "inputs": [ + "sum_21" + ], + "output": "add_142", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_63", + "inputs": [ + "add_142" + ], + "output": "rsqrt_63", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_181", + "inputs": [ + "view_86", + "rsqrt_63" + ], + "output": "mul_181", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_182", + "inputs": [ + "view_87" + ], + "output": "mul_182", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_22", + "inputs": [ + "mul_182" + ], + "output": "sum_22", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_143", + "inputs": [ + "sum_22" + ], + "output": "add_143", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_64", + "inputs": [ + "add_143" + ], + "output": "rsqrt_64", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_183", + "inputs": [ + "view_87", + "rsqrt_64" + ], + "output": "mul_183", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_10", + "inputs": [ + "mul_181", + "mul_183", + "view_88", + "mul_179", + "sigmoid_13", + "states_27" + ], + "output": "normalized_gated_delta_rule_10", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_126", + "inputs": [ + "normalized_gated_delta_rule_10" + ], + "output": "slice_126", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_27", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_127", + "inputs": [ + "normalized_gated_delta_rule_10" + ], + "output": "slice_127", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_60", + "inputs": [ + "slice_127" + ], + "output": "transpose_60", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_22", + "inputs": [ + "transpose_60" + ], + "output": "clone_22", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_89", + "inputs": [ + "clone_22" + ], + "output": "view_89", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_90", + "inputs": [ + "view_85" + ], + "output": "view_90", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_185", + "inputs": [ + "view_89", + "p_model_model_language_model_layers_13_linear_attn_norm_weight" + ], + "output": "mul_185", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_186", + "inputs": [ + "view_90", + "mul_185" + ], + "output": "mul_186", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_91", + "inputs": [ + "mul_186" + ], + "output": "view_91", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_105", + "inputs": [ + "view_91", + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight" + ], + "output": "linear_105", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_145", + "inputs": [ + "add_138", + "linear_105" + ], + "output": "add_145", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_188", + "inputs": [ + "add_145", + "p_model_model_language_model_layers_13_post_attention_layernorm_weight" + ], + "output": "mul_188", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_33", + "inputs": [ + "mul_188" + ], + "output": "type_as_33", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_106", + "inputs": [ + "type_as_33", + "p_model_model_language_model_layers_13_mlp_gate_proj_weight" + ], + "output": "linear_106", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_107", + "inputs": [ + "type_as_33", + "p_model_model_language_model_layers_13_mlp_up_proj_weight" + ], + "output": "linear_107", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_189", + "inputs": [ + "linear_106", + "linear_107" + ], + "output": "mul_189", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_108", + "inputs": [ + "mul_189", + "p_model_model_language_model_layers_13_mlp_down_proj_weight" + ], + "output": "linear_108", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_148", + "inputs": [ + "add_145", + "linear_108" + ], + "output": "add_148", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_191", + "inputs": [ + "add_148", + "p_model_model_language_model_layers_14_input_layernorm_weight" + ], + "output": "mul_191", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_34", + "inputs": [ + "mul_191" + ], + "output": "type_as_34", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_109", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_109", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_61", + "inputs": [ + "linear_109" + ], + "output": "transpose_61", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_110", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight" + ], + "output": "linear_110", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_92", + "inputs": [ + "linear_110" + ], + "output": "view_92", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_111", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight" + ], + "output": "linear_111", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_112", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight" + ], + "output": "linear_112", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_24", + "inputs": [ + "states_28", + "transpose_61" + ], + "output": "cat_24", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_128", + "inputs": [ + "cat_24" + ], + "output": "slice_128", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_28", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_11", + "inputs": [ + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight" + ], + "output": "squeeze_11", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_27", + "inputs": [ + "squeeze_11" + ], + "output": "unsqueeze_27", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_11", + "inputs": [ + "cat_24", + "unsqueeze_27" + ], + "output": "conv1d_11", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_129", + "inputs": [ + "conv1d_11" + ], + "output": "slice_129", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_36", + "inputs": [ + "slice_129" + ], + "output": "silu_36", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_130", + "inputs": [ + "silu_36" + ], + "output": "slice_130", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_62", + "inputs": [ + "slice_130" + ], + "output": "transpose_62", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_131", + "inputs": [ + "transpose_62" + ], + "output": "slice_131", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_132", + "inputs": [ + "transpose_62" + ], + "output": "slice_132", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_133", + "inputs": [ + "transpose_62" + ], + "output": "slice_133", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_93", + "inputs": [ + "slice_131" + ], + "output": "view_93", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_94", + "inputs": [ + "slice_132" + ], + "output": "view_94", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_95", + "inputs": [ + "slice_133" + ], + "output": "view_95", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_14", + "inputs": [ + "linear_111" + ], + "output": "sigmoid_14", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_11", + "inputs": [ + "p_model_model_language_model_layers_14_linear_attn_a_log" + ], + "output": "exp_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_17", + "inputs": [ + "exp_11" + ], + "output": "neg_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_151", + "inputs": [ + "linear_112", + "p_model_model_language_model_layers_14_linear_attn_dt_bias" + ], + "output": "add_151", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_11", + "inputs": [ + "add_151" + ], + "output": "softplus_11", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_192", + "inputs": [ + "neg_17", + "softplus_11" + ], + "output": "mul_192", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_193", + "inputs": [ + "view_93" + ], + "output": "mul_193", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_23", + "inputs": [ + "mul_193" + ], + "output": "sum_23", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_152", + "inputs": [ + "sum_23" + ], + "output": "add_152", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_68", + "inputs": [ + "add_152" + ], + "output": "rsqrt_68", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_194", + "inputs": [ + "view_93", + "rsqrt_68" + ], + "output": "mul_194", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_195", + "inputs": [ + "view_94" + ], + "output": "mul_195", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_24", + "inputs": [ + "mul_195" + ], + "output": "sum_24", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_153", + "inputs": [ + "sum_24" + ], + "output": "add_153", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_69", + "inputs": [ + "add_153" + ], + "output": "rsqrt_69", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_196", + "inputs": [ + "view_94", + "rsqrt_69" + ], + "output": "mul_196", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_11", + "inputs": [ + "mul_194", + "mul_196", + "view_95", + "mul_192", + "sigmoid_14", + "states_29" + ], + "output": "normalized_gated_delta_rule_11", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_134", + "inputs": [ + "normalized_gated_delta_rule_11" + ], + "output": "slice_134", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_29", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_135", + "inputs": [ + "normalized_gated_delta_rule_11" + ], + "output": "slice_135", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_63", + "inputs": [ + "slice_135" + ], + "output": "transpose_63", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_23", + "inputs": [ + "transpose_63" + ], + "output": "clone_23", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_96", + "inputs": [ + "clone_23" + ], + "output": "view_96", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_97", + "inputs": [ + "view_92" + ], + "output": "view_97", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_198", + "inputs": [ + "view_96", + "p_model_model_language_model_layers_14_linear_attn_norm_weight" + ], + "output": "mul_198", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_199", + "inputs": [ + "view_97", + "mul_198" + ], + "output": "mul_199", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_98", + "inputs": [ + "mul_199" + ], + "output": "view_98", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_113", + "inputs": [ + "view_98", + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight" + ], + "output": "linear_113", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_155", + "inputs": [ + "add_148", + "linear_113" + ], + "output": "add_155", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_201", + "inputs": [ + "add_155", + "p_model_model_language_model_layers_14_post_attention_layernorm_weight" + ], + "output": "mul_201", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_35", + "inputs": [ + "mul_201" + ], + "output": "type_as_35", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_114", + "inputs": [ + "type_as_35", + "p_model_model_language_model_layers_14_mlp_gate_proj_weight" + ], + "output": "linear_114", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_115", + "inputs": [ + "type_as_35", + "p_model_model_language_model_layers_14_mlp_up_proj_weight" + ], + "output": "linear_115", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_202", + "inputs": [ + "linear_114", + "linear_115" + ], + "output": "mul_202", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_116", + "inputs": [ + "mul_202", + "p_model_model_language_model_layers_14_mlp_down_proj_weight" + ], + "output": "linear_116", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_158", + "inputs": [ + "add_155", + "linear_116" + ], + "output": "add_158", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_204", + "inputs": [ + "add_158", + "p_model_model_language_model_layers_15_input_layernorm_weight" + ], + "output": "mul_204", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_36", + "inputs": [ + "mul_204" + ], + "output": "type_as_36", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_117", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_q_proj_weight" + ], + "output": "linear_117", + "workgroups": [ + 512, + 2, + 1 + ], + "kernel": "kernels/4e0fada2b6f07e141f088694ab936356f2c70b66fb98e95e537c2c9d7ffb518a.wgsl" + }, + { + "node": "view_99", + "inputs": [ + "linear_117" + ], + "output": "view_99", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl" + }, + { + "node": "slice_136", + "inputs": [ + "view_99" + ], + "output": "slice_136", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl" + }, + { + "node": "slice_137", + "inputs": [ + "view_99" + ], + "output": "slice_137", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl" + }, + { + "node": "clone_24", + "inputs": [ + "slice_137" + ], + "output": "clone_24", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "_unsafe_view_9", + "inputs": [ + "clone_24" + ], + "output": "_unsafe_view_9", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_100", + "inputs": [ + "slice_136" + ], + "output": "view_100", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_206", + "inputs": [ + "view_100", + "p_model_model_language_model_layers_15_self_attn_q_norm_weight" + ], + "output": "mul_206", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_37", + "inputs": [ + "mul_206" + ], + "output": "type_as_37", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_64", + "inputs": [ + "type_as_37" + ], + "output": "transpose_64", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl" + }, + { + "node": "linear_118", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_k_proj_weight" + ], + "output": "linear_118", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_101", + "inputs": [ + "linear_118" + ], + "output": "view_101", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_208", + "inputs": [ + "view_101", + "p_model_model_language_model_layers_15_self_attn_k_norm_weight" + ], + "output": "mul_208", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_38", + "inputs": [ + "mul_208" + ], + "output": "type_as_38", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_65", + "inputs": [ + "type_as_38" + ], + "output": "transpose_65", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "linear_119", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_v_proj_weight" + ], + "output": "linear_119", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_102", + "inputs": [ + "linear_119" + ], + "output": "view_102", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_66", + "inputs": [ + "view_102" + ], + "output": "transpose_66", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "unsqueeze_28", + "inputs": [ + "mul" + ], + "output": "unsqueeze_28", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "unsqueeze_29", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_29", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "slice_138", + "inputs": [ + "transpose_64" + ], + "output": "slice_138", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl" + }, + { + "node": "slice_139", + "inputs": [ + "transpose_64" + ], + "output": "slice_139", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl" + }, + { + "node": "slice_140", + "inputs": [ + "transpose_65" + ], + "output": "slice_140", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl" + }, + { + "node": "slice_141", + "inputs": [ + "transpose_65" + ], + "output": "slice_141", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl" + }, + { + "node": "mul_209", + "inputs": [ + "slice_138", + "unsqueeze_28" + ], + "output": "mul_209", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "slice_142", + "inputs": [ + "slice_138" + ], + "output": "slice_142", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl" + }, + { + "node": "slice_143", + "inputs": [ + "slice_138" + ], + "output": "slice_143", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl" + }, + { + "node": "neg_18", + "inputs": [ + "slice_143" + ], + "output": "neg_18", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_25", + "inputs": [ + "neg_18", + "slice_142" + ], + "output": "cat_25", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_210", + "inputs": [ + "cat_25", + "unsqueeze_29" + ], + "output": "mul_210", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "add_165", + "inputs": [ + "mul_209", + "mul_210" + ], + "output": "add_165", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_211", + "inputs": [ + "slice_140", + "unsqueeze_28" + ], + "output": "mul_211", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "slice_144", + "inputs": [ + "slice_140" + ], + "output": "slice_144", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl" + }, + { + "node": "slice_145", + "inputs": [ + "slice_140" + ], + "output": "slice_145", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl" + }, + { + "node": "neg_19", + "inputs": [ + "slice_145" + ], + "output": "neg_19", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_26", + "inputs": [ + "neg_19", + "slice_144" + ], + "output": "cat_26", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_212", + "inputs": [ + "cat_26", + "unsqueeze_29" + ], + "output": "mul_212", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "add_166", + "inputs": [ + "mul_211", + "mul_212" + ], + "output": "add_166", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "cat_27", + "inputs": [ + "add_165", + "slice_139" + ], + "output": "cat_27", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cat_28", + "inputs": [ + "add_166", + "slice_141" + ], + "output": "cat_28", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cache_update_6", + "inputs": [ + "cat_28", + "cache_position" + ], + "output": "cache_update_6", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_30", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "cache_update_7", + "inputs": [ + "transpose_66", + "cache_position" + ], + "output": "cache_update_7", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_31", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "unsqueeze_30", + "inputs": [ + "cache_update_6" + ], + "output": "unsqueeze_30", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_7", + "inputs": [ + "unsqueeze_30" + ], + "output": "expand_7", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_25", + "inputs": [ + "expand_7" + ], + "output": "clone_25", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_10", + "inputs": [ + "clone_25" + ], + "output": "_unsafe_view_10", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_31", + "inputs": [ + "cache_update_7" + ], + "output": "unsqueeze_31", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_8", + "inputs": [ + "unsqueeze_31" + ], + "output": "expand_8", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_26", + "inputs": [ + "expand_8" + ], + "output": "clone_26", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_11", + "inputs": [ + "clone_26" + ], + "output": "_unsafe_view_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_67", + "inputs": [ + "_unsafe_view_10" + ], + "output": "transpose_67", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_7", + "inputs": [ + "cat_27", + "transpose_67" + ], + "output": "matmul_7", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl" + }, + { + "node": "mul_213", + "inputs": [ + "matmul_7" + ], + "output": "mul_213", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl" + }, + { + "node": "add_167", + "inputs": [ + "mul_213", + "attention_mask" + ], + "output": "add_167", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl" + }, + { + "node": "softmax_3", + "inputs": [ + "add_167" + ], + "output": "softmax_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl" + }, + { + "node": "matmul_8", + "inputs": [ + "softmax_3", + "_unsafe_view_11" + ], + "output": "matmul_8", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl" + }, + { + "node": "transpose_68", + "inputs": [ + "matmul_8" + ], + "output": "transpose_68", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl" + }, + { + "node": "clone_27", + "inputs": [ + "transpose_68" + ], + "output": "clone_27", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_103", + "inputs": [ + "clone_27" + ], + "output": "view_103", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_15", + "inputs": [ + "_unsafe_view_9" + ], + "output": "sigmoid_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl" + }, + { + "node": "mul_214", + "inputs": [ + "view_103", + "sigmoid_15" + ], + "output": "mul_214", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl" + }, + { + "node": "linear_120", + "inputs": [ + "mul_214", + "p_model_model_language_model_layers_15_self_attn_o_proj_weight" + ], + "output": "linear_120", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_168", + "inputs": [ + "add_158", + "linear_120" + ], + "output": "add_168", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_216", + "inputs": [ + "add_168", + "p_model_model_language_model_layers_15_post_attention_layernorm_weight" + ], + "output": "mul_216", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_39", + "inputs": [ + "mul_216" + ], + "output": "type_as_39", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_121", + "inputs": [ + "type_as_39", + "p_model_model_language_model_layers_15_mlp_gate_proj_weight" + ], + "output": "linear_121", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_122", + "inputs": [ + "type_as_39", + "p_model_model_language_model_layers_15_mlp_up_proj_weight" + ], + "output": "linear_122", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_217", + "inputs": [ + "linear_121", + "linear_122" + ], + "output": "mul_217", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_123", + "inputs": [ + "mul_217", + "p_model_model_language_model_layers_15_mlp_down_proj_weight" + ], + "output": "linear_123", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_171", + "inputs": [ + "add_168", + "linear_123" + ], + "output": "add_171", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_219", + "inputs": [ + "add_171", + "p_model_model_language_model_layers_16_input_layernorm_weight" + ], + "output": "mul_219", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_40", + "inputs": [ + "mul_219" + ], + "output": "type_as_40", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_124", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_124", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_69", + "inputs": [ + "linear_124" + ], + "output": "transpose_69", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_125", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight" + ], + "output": "linear_125", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_104", + "inputs": [ + "linear_125" + ], + "output": "view_104", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_126", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight" + ], + "output": "linear_126", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_127", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight" + ], + "output": "linear_127", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_29", + "inputs": [ + "states_32", + "transpose_69" + ], + "output": "cat_29", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_146", + "inputs": [ + "cat_29" + ], + "output": "slice_146", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_32", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_12", + "inputs": [ + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight" + ], + "output": "squeeze_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_32", + "inputs": [ + "squeeze_12" + ], + "output": "unsqueeze_32", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_12", + "inputs": [ + "cat_29", + "unsqueeze_32" + ], + "output": "conv1d_12", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_147", + "inputs": [ + "conv1d_12" + ], + "output": "slice_147", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_40", + "inputs": [ + "slice_147" + ], + "output": "silu_40", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_148", + "inputs": [ + "silu_40" + ], + "output": "slice_148", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_70", + "inputs": [ + "slice_148" + ], + "output": "transpose_70", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_149", + "inputs": [ + "transpose_70" + ], + "output": "slice_149", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_150", + "inputs": [ + "transpose_70" + ], + "output": "slice_150", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_151", + "inputs": [ + "transpose_70" + ], + "output": "slice_151", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_105", + "inputs": [ + "slice_149" + ], + "output": "view_105", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_106", + "inputs": [ + "slice_150" + ], + "output": "view_106", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_107", + "inputs": [ + "slice_151" + ], + "output": "view_107", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_16", + "inputs": [ + "linear_126" + ], + "output": "sigmoid_16", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_12", + "inputs": [ + "p_model_model_language_model_layers_16_linear_attn_a_log" + ], + "output": "exp_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_20", + "inputs": [ + "exp_12" + ], + "output": "neg_20", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_174", + "inputs": [ + "linear_127", + "p_model_model_language_model_layers_16_linear_attn_dt_bias" + ], + "output": "add_174", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_12", + "inputs": [ + "add_174" + ], + "output": "softplus_12", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_220", + "inputs": [ + "neg_20", + "softplus_12" + ], + "output": "mul_220", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_221", + "inputs": [ + "view_105" + ], + "output": "mul_221", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_25", + "inputs": [ + "mul_221" + ], + "output": "sum_25", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_175", + "inputs": [ + "sum_25" + ], + "output": "add_175", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_77", + "inputs": [ + "add_175" + ], + "output": "rsqrt_77", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_222", + "inputs": [ + "view_105", + "rsqrt_77" + ], + "output": "mul_222", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_223", + "inputs": [ + "view_106" + ], + "output": "mul_223", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_26", + "inputs": [ + "mul_223" + ], + "output": "sum_26", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_176", + "inputs": [ + "sum_26" + ], + "output": "add_176", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_78", + "inputs": [ + "add_176" + ], + "output": "rsqrt_78", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_224", + "inputs": [ + "view_106", + "rsqrt_78" + ], + "output": "mul_224", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_12", + "inputs": [ + "mul_222", + "mul_224", + "view_107", + "mul_220", + "sigmoid_16", + "states_33" + ], + "output": "normalized_gated_delta_rule_12", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_152", + "inputs": [ + "normalized_gated_delta_rule_12" + ], + "output": "slice_152", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_33", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_153", + "inputs": [ + "normalized_gated_delta_rule_12" + ], + "output": "slice_153", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_71", + "inputs": [ + "slice_153" + ], + "output": "transpose_71", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_28", + "inputs": [ + "transpose_71" + ], + "output": "clone_28", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_108", + "inputs": [ + "clone_28" + ], + "output": "view_108", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_109", + "inputs": [ + "view_104" + ], + "output": "view_109", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_226", + "inputs": [ + "view_108", + "p_model_model_language_model_layers_16_linear_attn_norm_weight" + ], + "output": "mul_226", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_227", + "inputs": [ + "view_109", + "mul_226" + ], + "output": "mul_227", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_110", + "inputs": [ + "mul_227" + ], + "output": "view_110", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_128", + "inputs": [ + "view_110", + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight" + ], + "output": "linear_128", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_178", + "inputs": [ + "add_171", + "linear_128" + ], + "output": "add_178", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_229", + "inputs": [ + "add_178", + "p_model_model_language_model_layers_16_post_attention_layernorm_weight" + ], + "output": "mul_229", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_41", + "inputs": [ + "mul_229" + ], + "output": "type_as_41", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_129", + "inputs": [ + "type_as_41", + "p_model_model_language_model_layers_16_mlp_gate_proj_weight" + ], + "output": "linear_129", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_130", + "inputs": [ + "type_as_41", + "p_model_model_language_model_layers_16_mlp_up_proj_weight" + ], + "output": "linear_130", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_230", + "inputs": [ + "linear_129", + "linear_130" + ], + "output": "mul_230", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_131", + "inputs": [ + "mul_230", + "p_model_model_language_model_layers_16_mlp_down_proj_weight" + ], + "output": "linear_131", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_181", + "inputs": [ + "add_178", + "linear_131" + ], + "output": "add_181", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_232", + "inputs": [ + "add_181", + "p_model_model_language_model_layers_17_input_layernorm_weight" + ], + "output": "mul_232", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_42", + "inputs": [ + "mul_232" + ], + "output": "type_as_42", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_132", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_132", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_72", + "inputs": [ + "linear_132" + ], + "output": "transpose_72", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_133", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight" + ], + "output": "linear_133", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_111", + "inputs": [ + "linear_133" + ], + "output": "view_111", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_134", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight" + ], + "output": "linear_134", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_135", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight" + ], + "output": "linear_135", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_30", + "inputs": [ + "states_34", + "transpose_72" + ], + "output": "cat_30", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_154", + "inputs": [ + "cat_30" + ], + "output": "slice_154", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_34", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_13", + "inputs": [ + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight" + ], + "output": "squeeze_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_33", + "inputs": [ + "squeeze_13" + ], + "output": "unsqueeze_33", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_13", + "inputs": [ + "cat_30", + "unsqueeze_33" + ], + "output": "conv1d_13", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_155", + "inputs": [ + "conv1d_13" + ], + "output": "slice_155", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_43", + "inputs": [ + "slice_155" + ], + "output": "silu_43", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_156", + "inputs": [ + "silu_43" + ], + "output": "slice_156", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_73", + "inputs": [ + "slice_156" + ], + "output": "transpose_73", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_157", + "inputs": [ + "transpose_73" + ], + "output": "slice_157", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_158", + "inputs": [ + "transpose_73" + ], + "output": "slice_158", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_159", + "inputs": [ + "transpose_73" + ], + "output": "slice_159", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_112", + "inputs": [ + "slice_157" + ], + "output": "view_112", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_113", + "inputs": [ + "slice_158" + ], + "output": "view_113", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_114", + "inputs": [ + "slice_159" + ], + "output": "view_114", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_17", + "inputs": [ + "linear_134" + ], + "output": "sigmoid_17", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_13", + "inputs": [ + "p_model_model_language_model_layers_17_linear_attn_a_log" + ], + "output": "exp_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_21", + "inputs": [ + "exp_13" + ], + "output": "neg_21", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_184", + "inputs": [ + "linear_135", + "p_model_model_language_model_layers_17_linear_attn_dt_bias" + ], + "output": "add_184", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_13", + "inputs": [ + "add_184" + ], + "output": "softplus_13", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_233", + "inputs": [ + "neg_21", + "softplus_13" + ], + "output": "mul_233", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_234", + "inputs": [ + "view_112" + ], + "output": "mul_234", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_27", + "inputs": [ + "mul_234" + ], + "output": "sum_27", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_185", + "inputs": [ + "sum_27" + ], + "output": "add_185", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_82", + "inputs": [ + "add_185" + ], + "output": "rsqrt_82", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_235", + "inputs": [ + "view_112", + "rsqrt_82" + ], + "output": "mul_235", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_236", + "inputs": [ + "view_113" + ], + "output": "mul_236", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_28", + "inputs": [ + "mul_236" + ], + "output": "sum_28", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_186", + "inputs": [ + "sum_28" + ], + "output": "add_186", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_83", + "inputs": [ + "add_186" + ], + "output": "rsqrt_83", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_237", + "inputs": [ + "view_113", + "rsqrt_83" + ], + "output": "mul_237", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_13", + "inputs": [ + "mul_235", + "mul_237", + "view_114", + "mul_233", + "sigmoid_17", + "states_35" + ], + "output": "normalized_gated_delta_rule_13", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_160", + "inputs": [ + "normalized_gated_delta_rule_13" + ], + "output": "slice_160", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_35", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_161", + "inputs": [ + "normalized_gated_delta_rule_13" + ], + "output": "slice_161", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_74", + "inputs": [ + "slice_161" + ], + "output": "transpose_74", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_29", + "inputs": [ + "transpose_74" + ], + "output": "clone_29", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_115", + "inputs": [ + "clone_29" + ], + "output": "view_115", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_116", + "inputs": [ + "view_111" + ], + "output": "view_116", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_239", + "inputs": [ + "view_115", + "p_model_model_language_model_layers_17_linear_attn_norm_weight" + ], + "output": "mul_239", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_240", + "inputs": [ + "view_116", + "mul_239" + ], + "output": "mul_240", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_117", + "inputs": [ + "mul_240" + ], + "output": "view_117", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_136", + "inputs": [ + "view_117", + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight" + ], + "output": "linear_136", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_188", + "inputs": [ + "add_181", + "linear_136" + ], + "output": "add_188", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_242", + "inputs": [ + "add_188", + "p_model_model_language_model_layers_17_post_attention_layernorm_weight" + ], + "output": "mul_242", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_43", + "inputs": [ + "mul_242" + ], + "output": "type_as_43", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_137", + "inputs": [ + "type_as_43", + "p_model_model_language_model_layers_17_mlp_gate_proj_weight" + ], + "output": "linear_137", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_138", + "inputs": [ + "type_as_43", + "p_model_model_language_model_layers_17_mlp_up_proj_weight" + ], + "output": "linear_138", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_243", + "inputs": [ + "linear_137", + "linear_138" + ], + "output": "mul_243", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_139", + "inputs": [ + "mul_243", + "p_model_model_language_model_layers_17_mlp_down_proj_weight" + ], + "output": "linear_139", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_191", + "inputs": [ + "add_188", + "linear_139" + ], + "output": "add_191", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_245", + "inputs": [ + "add_191", + "p_model_model_language_model_layers_18_input_layernorm_weight" + ], + "output": "mul_245", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_44", + "inputs": [ + "mul_245" + ], + "output": "type_as_44", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_140", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_140", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_75", + "inputs": [ + "linear_140" + ], + "output": "transpose_75", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_141", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight" + ], + "output": "linear_141", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_118", + "inputs": [ + "linear_141" + ], + "output": "view_118", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_142", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight" + ], + "output": "linear_142", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_143", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight" + ], + "output": "linear_143", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_31", + "inputs": [ + "states_36", + "transpose_75" + ], + "output": "cat_31", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_162", + "inputs": [ + "cat_31" + ], + "output": "slice_162", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_36", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_14", + "inputs": [ + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight" + ], + "output": "squeeze_14", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_34", + "inputs": [ + "squeeze_14" + ], + "output": "unsqueeze_34", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_14", + "inputs": [ + "cat_31", + "unsqueeze_34" + ], + "output": "conv1d_14", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_163", + "inputs": [ + "conv1d_14" + ], + "output": "slice_163", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_46", + "inputs": [ + "slice_163" + ], + "output": "silu_46", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_164", + "inputs": [ + "silu_46" + ], + "output": "slice_164", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_76", + "inputs": [ + "slice_164" + ], + "output": "transpose_76", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_165", + "inputs": [ + "transpose_76" + ], + "output": "slice_165", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_166", + "inputs": [ + "transpose_76" + ], + "output": "slice_166", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_167", + "inputs": [ + "transpose_76" + ], + "output": "slice_167", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_119", + "inputs": [ + "slice_165" + ], + "output": "view_119", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_120", + "inputs": [ + "slice_166" + ], + "output": "view_120", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_121", + "inputs": [ + "slice_167" + ], + "output": "view_121", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_18", + "inputs": [ + "linear_142" + ], + "output": "sigmoid_18", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_14", + "inputs": [ + "p_model_model_language_model_layers_18_linear_attn_a_log" + ], + "output": "exp_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_22", + "inputs": [ + "exp_14" + ], + "output": "neg_22", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_194", + "inputs": [ + "linear_143", + "p_model_model_language_model_layers_18_linear_attn_dt_bias" + ], + "output": "add_194", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_14", + "inputs": [ + "add_194" + ], + "output": "softplus_14", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_246", + "inputs": [ + "neg_22", + "softplus_14" + ], + "output": "mul_246", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_247", + "inputs": [ + "view_119" + ], + "output": "mul_247", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_29", + "inputs": [ + "mul_247" + ], + "output": "sum_29", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_195", + "inputs": [ + "sum_29" + ], + "output": "add_195", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_87", + "inputs": [ + "add_195" + ], + "output": "rsqrt_87", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_248", + "inputs": [ + "view_119", + "rsqrt_87" + ], + "output": "mul_248", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_249", + "inputs": [ + "view_120" + ], + "output": "mul_249", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_30", + "inputs": [ + "mul_249" + ], + "output": "sum_30", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_196", + "inputs": [ + "sum_30" + ], + "output": "add_196", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_88", + "inputs": [ + "add_196" + ], + "output": "rsqrt_88", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_250", + "inputs": [ + "view_120", + "rsqrt_88" + ], + "output": "mul_250", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_14", + "inputs": [ + "mul_248", + "mul_250", + "view_121", + "mul_246", + "sigmoid_18", + "states_37" + ], + "output": "normalized_gated_delta_rule_14", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_168", + "inputs": [ + "normalized_gated_delta_rule_14" + ], + "output": "slice_168", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_37", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_169", + "inputs": [ + "normalized_gated_delta_rule_14" + ], + "output": "slice_169", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_77", + "inputs": [ + "slice_169" + ], + "output": "transpose_77", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_30", + "inputs": [ + "transpose_77" + ], + "output": "clone_30", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_122", + "inputs": [ + "clone_30" + ], + "output": "view_122", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_123", + "inputs": [ + "view_118" + ], + "output": "view_123", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_252", + "inputs": [ + "view_122", + "p_model_model_language_model_layers_18_linear_attn_norm_weight" + ], + "output": "mul_252", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_253", + "inputs": [ + "view_123", + "mul_252" + ], + "output": "mul_253", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_124", + "inputs": [ + "mul_253" + ], + "output": "view_124", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_144", + "inputs": [ + "view_124", + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight" + ], + "output": "linear_144", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_198", + "inputs": [ + "add_191", + "linear_144" + ], + "output": "add_198", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_255", + "inputs": [ + "add_198", + "p_model_model_language_model_layers_18_post_attention_layernorm_weight" + ], + "output": "mul_255", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_45", + "inputs": [ + "mul_255" + ], + "output": "type_as_45", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_145", + "inputs": [ + "type_as_45", + "p_model_model_language_model_layers_18_mlp_gate_proj_weight" + ], + "output": "linear_145", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_146", + "inputs": [ + "type_as_45", + "p_model_model_language_model_layers_18_mlp_up_proj_weight" + ], + "output": "linear_146", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_256", + "inputs": [ + "linear_145", + "linear_146" + ], + "output": "mul_256", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_147", + "inputs": [ + "mul_256", + "p_model_model_language_model_layers_18_mlp_down_proj_weight" + ], + "output": "linear_147", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_201", + "inputs": [ + "add_198", + "linear_147" + ], + "output": "add_201", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_258", + "inputs": [ + "add_201", + "p_model_model_language_model_layers_19_input_layernorm_weight" + ], + "output": "mul_258", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_46", + "inputs": [ + "mul_258" + ], + "output": "type_as_46", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_148", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_q_proj_weight" + ], + "output": "linear_148", + "workgroups": [ + 512, + 2, + 1 + ], + "kernel": "kernels/4e0fada2b6f07e141f088694ab936356f2c70b66fb98e95e537c2c9d7ffb518a.wgsl" + }, + { + "node": "view_125", + "inputs": [ + "linear_148" + ], + "output": "view_125", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl" + }, + { + "node": "slice_170", + "inputs": [ + "view_125" + ], + "output": "slice_170", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl" + }, + { + "node": "slice_171", + "inputs": [ + "view_125" + ], + "output": "slice_171", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl" + }, + { + "node": "clone_31", + "inputs": [ + "slice_171" + ], + "output": "clone_31", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "_unsafe_view_12", + "inputs": [ + "clone_31" + ], + "output": "_unsafe_view_12", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_126", + "inputs": [ + "slice_170" + ], + "output": "view_126", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_260", + "inputs": [ + "view_126", + "p_model_model_language_model_layers_19_self_attn_q_norm_weight" + ], + "output": "mul_260", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_47", + "inputs": [ + "mul_260" + ], + "output": "type_as_47", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_78", + "inputs": [ + "type_as_47" + ], + "output": "transpose_78", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl" + }, + { + "node": "linear_149", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_k_proj_weight" + ], + "output": "linear_149", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_127", + "inputs": [ + "linear_149" + ], + "output": "view_127", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_262", + "inputs": [ + "view_127", + "p_model_model_language_model_layers_19_self_attn_k_norm_weight" + ], + "output": "mul_262", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_48", + "inputs": [ + "mul_262" + ], + "output": "type_as_48", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_79", + "inputs": [ + "type_as_48" + ], + "output": "transpose_79", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "linear_150", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_v_proj_weight" + ], + "output": "linear_150", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_128", + "inputs": [ + "linear_150" + ], + "output": "view_128", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_80", + "inputs": [ + "view_128" + ], + "output": "transpose_80", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "unsqueeze_35", + "inputs": [ + "mul" + ], + "output": "unsqueeze_35", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "unsqueeze_36", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_36", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "slice_172", + "inputs": [ + "transpose_78" + ], + "output": "slice_172", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl" + }, + { + "node": "slice_173", + "inputs": [ + "transpose_78" + ], + "output": "slice_173", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl" + }, + { + "node": "slice_174", + "inputs": [ + "transpose_79" + ], + "output": "slice_174", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl" + }, + { + "node": "slice_175", + "inputs": [ + "transpose_79" + ], + "output": "slice_175", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl" + }, + { + "node": "mul_263", + "inputs": [ + "slice_172", + "unsqueeze_35" + ], + "output": "mul_263", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "slice_176", + "inputs": [ + "slice_172" + ], + "output": "slice_176", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl" + }, + { + "node": "slice_177", + "inputs": [ + "slice_172" + ], + "output": "slice_177", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl" + }, + { + "node": "neg_23", + "inputs": [ + "slice_177" + ], + "output": "neg_23", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_32", + "inputs": [ + "neg_23", + "slice_176" + ], + "output": "cat_32", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_264", + "inputs": [ + "cat_32", + "unsqueeze_36" + ], + "output": "mul_264", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "add_208", + "inputs": [ + "mul_263", + "mul_264" + ], + "output": "add_208", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_265", + "inputs": [ + "slice_174", + "unsqueeze_35" + ], + "output": "mul_265", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "slice_178", + "inputs": [ + "slice_174" + ], + "output": "slice_178", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl" + }, + { + "node": "slice_179", + "inputs": [ + "slice_174" + ], + "output": "slice_179", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl" + }, + { + "node": "neg_24", + "inputs": [ + "slice_179" + ], + "output": "neg_24", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_33", + "inputs": [ + "neg_24", + "slice_178" + ], + "output": "cat_33", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_266", + "inputs": [ + "cat_33", + "unsqueeze_36" + ], + "output": "mul_266", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "add_209", + "inputs": [ + "mul_265", + "mul_266" + ], + "output": "add_209", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "cat_34", + "inputs": [ + "add_208", + "slice_173" + ], + "output": "cat_34", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cat_35", + "inputs": [ + "add_209", + "slice_175" + ], + "output": "cat_35", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cache_update_8", + "inputs": [ + "cat_35", + "cache_position" + ], + "output": "cache_update_8", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_38", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "cache_update_9", + "inputs": [ + "transpose_80", + "cache_position" + ], + "output": "cache_update_9", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_39", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "unsqueeze_37", + "inputs": [ + "cache_update_8" + ], + "output": "unsqueeze_37", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_9", + "inputs": [ + "unsqueeze_37" + ], + "output": "expand_9", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_32", + "inputs": [ + "expand_9" + ], + "output": "clone_32", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_13", + "inputs": [ + "clone_32" + ], + "output": "_unsafe_view_13", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_38", + "inputs": [ + "cache_update_9" + ], + "output": "unsqueeze_38", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_10", + "inputs": [ + "unsqueeze_38" + ], + "output": "expand_10", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_33", + "inputs": [ + "expand_10" + ], + "output": "clone_33", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_14", + "inputs": [ + "clone_33" + ], + "output": "_unsafe_view_14", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_81", + "inputs": [ + "_unsafe_view_13" + ], + "output": "transpose_81", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_9", + "inputs": [ + "cat_34", + "transpose_81" + ], + "output": "matmul_9", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl" + }, + { + "node": "mul_267", + "inputs": [ + "matmul_9" + ], + "output": "mul_267", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl" + }, + { + "node": "add_210", + "inputs": [ + "mul_267", + "attention_mask" + ], + "output": "add_210", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl" + }, + { + "node": "softmax_4", + "inputs": [ + "add_210" + ], + "output": "softmax_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl" + }, + { + "node": "matmul_10", + "inputs": [ + "softmax_4", + "_unsafe_view_14" + ], + "output": "matmul_10", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl" + }, + { + "node": "transpose_82", + "inputs": [ + "matmul_10" + ], + "output": "transpose_82", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl" + }, + { + "node": "clone_34", + "inputs": [ + "transpose_82" + ], + "output": "clone_34", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_129", + "inputs": [ + "clone_34" + ], + "output": "view_129", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_19", + "inputs": [ + "_unsafe_view_12" + ], + "output": "sigmoid_19", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl" + }, + { + "node": "mul_268", + "inputs": [ + "view_129", + "sigmoid_19" + ], + "output": "mul_268", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl" + }, + { + "node": "linear_151", + "inputs": [ + "mul_268", + "p_model_model_language_model_layers_19_self_attn_o_proj_weight" + ], + "output": "linear_151", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_211", + "inputs": [ + "add_201", + "linear_151" + ], + "output": "add_211", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_270", + "inputs": [ + "add_211", + "p_model_model_language_model_layers_19_post_attention_layernorm_weight" + ], + "output": "mul_270", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_49", + "inputs": [ + "mul_270" + ], + "output": "type_as_49", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_152", + "inputs": [ + "type_as_49", + "p_model_model_language_model_layers_19_mlp_gate_proj_weight" + ], + "output": "linear_152", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_153", + "inputs": [ + "type_as_49", + "p_model_model_language_model_layers_19_mlp_up_proj_weight" + ], + "output": "linear_153", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_271", + "inputs": [ + "linear_152", + "linear_153" + ], + "output": "mul_271", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_154", + "inputs": [ + "mul_271", + "p_model_model_language_model_layers_19_mlp_down_proj_weight" + ], + "output": "linear_154", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_214", + "inputs": [ + "add_211", + "linear_154" + ], + "output": "add_214", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_273", + "inputs": [ + "add_214", + "p_model_model_language_model_layers_20_input_layernorm_weight" + ], + "output": "mul_273", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_50", + "inputs": [ + "mul_273" + ], + "output": "type_as_50", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_155", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_155", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_83", + "inputs": [ + "linear_155" + ], + "output": "transpose_83", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_156", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight" + ], + "output": "linear_156", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_130", + "inputs": [ + "linear_156" + ], + "output": "view_130", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_157", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight" + ], + "output": "linear_157", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_158", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight" + ], + "output": "linear_158", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_36", + "inputs": [ + "states_40", + "transpose_83" + ], + "output": "cat_36", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_180", + "inputs": [ + "cat_36" + ], + "output": "slice_180", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_40", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_15", + "inputs": [ + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight" + ], + "output": "squeeze_15", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_39", + "inputs": [ + "squeeze_15" + ], + "output": "unsqueeze_39", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_15", + "inputs": [ + "cat_36", + "unsqueeze_39" + ], + "output": "conv1d_15", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_181", + "inputs": [ + "conv1d_15" + ], + "output": "slice_181", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_50", + "inputs": [ + "slice_181" + ], + "output": "silu_50", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_182", + "inputs": [ + "silu_50" + ], + "output": "slice_182", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_84", + "inputs": [ + "slice_182" + ], + "output": "transpose_84", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_183", + "inputs": [ + "transpose_84" + ], + "output": "slice_183", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_184", + "inputs": [ + "transpose_84" + ], + "output": "slice_184", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_185", + "inputs": [ + "transpose_84" + ], + "output": "slice_185", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_131", + "inputs": [ + "slice_183" + ], + "output": "view_131", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_132", + "inputs": [ + "slice_184" + ], + "output": "view_132", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_133", + "inputs": [ + "slice_185" + ], + "output": "view_133", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_20", + "inputs": [ + "linear_157" + ], + "output": "sigmoid_20", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_15", + "inputs": [ + "p_model_model_language_model_layers_20_linear_attn_a_log" + ], + "output": "exp_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_25", + "inputs": [ + "exp_15" + ], + "output": "neg_25", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_217", + "inputs": [ + "linear_158", + "p_model_model_language_model_layers_20_linear_attn_dt_bias" + ], + "output": "add_217", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_15", + "inputs": [ + "add_217" + ], + "output": "softplus_15", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_274", + "inputs": [ + "neg_25", + "softplus_15" + ], + "output": "mul_274", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_275", + "inputs": [ + "view_131" + ], + "output": "mul_275", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_31", + "inputs": [ + "mul_275" + ], + "output": "sum_31", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_218", + "inputs": [ + "sum_31" + ], + "output": "add_218", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_96", + "inputs": [ + "add_218" + ], + "output": "rsqrt_96", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_276", + "inputs": [ + "view_131", + "rsqrt_96" + ], + "output": "mul_276", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_277", + "inputs": [ + "view_132" + ], + "output": "mul_277", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_32", + "inputs": [ + "mul_277" + ], + "output": "sum_32", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_219", + "inputs": [ + "sum_32" + ], + "output": "add_219", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_97", + "inputs": [ + "add_219" + ], + "output": "rsqrt_97", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_278", + "inputs": [ + "view_132", + "rsqrt_97" + ], + "output": "mul_278", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_15", + "inputs": [ + "mul_276", + "mul_278", + "view_133", + "mul_274", + "sigmoid_20", + "states_41" + ], + "output": "normalized_gated_delta_rule_15", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_186", + "inputs": [ + "normalized_gated_delta_rule_15" + ], + "output": "slice_186", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_41", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_187", + "inputs": [ + "normalized_gated_delta_rule_15" + ], + "output": "slice_187", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_85", + "inputs": [ + "slice_187" + ], + "output": "transpose_85", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_35", + "inputs": [ + "transpose_85" + ], + "output": "clone_35", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_134", + "inputs": [ + "clone_35" + ], + "output": "view_134", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_135", + "inputs": [ + "view_130" + ], + "output": "view_135", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_280", + "inputs": [ + "view_134", + "p_model_model_language_model_layers_20_linear_attn_norm_weight" + ], + "output": "mul_280", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_281", + "inputs": [ + "view_135", + "mul_280" + ], + "output": "mul_281", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_136", + "inputs": [ + "mul_281" + ], + "output": "view_136", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_159", + "inputs": [ + "view_136", + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight" + ], + "output": "linear_159", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_221", + "inputs": [ + "add_214", + "linear_159" + ], + "output": "add_221", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_283", + "inputs": [ + "add_221", + "p_model_model_language_model_layers_20_post_attention_layernorm_weight" + ], + "output": "mul_283", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_51", + "inputs": [ + "mul_283" + ], + "output": "type_as_51", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_160", + "inputs": [ + "type_as_51", + "p_model_model_language_model_layers_20_mlp_gate_proj_weight" + ], + "output": "linear_160", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_161", + "inputs": [ + "type_as_51", + "p_model_model_language_model_layers_20_mlp_up_proj_weight" + ], + "output": "linear_161", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_284", + "inputs": [ + "linear_160", + "linear_161" + ], + "output": "mul_284", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_162", + "inputs": [ + "mul_284", + "p_model_model_language_model_layers_20_mlp_down_proj_weight" + ], + "output": "linear_162", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_224", + "inputs": [ + "add_221", + "linear_162" + ], + "output": "add_224", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_286", + "inputs": [ + "add_224", + "p_model_model_language_model_layers_21_input_layernorm_weight" + ], + "output": "mul_286", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_52", + "inputs": [ + "mul_286" + ], + "output": "type_as_52", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_163", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_163", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_86", + "inputs": [ + "linear_163" + ], + "output": "transpose_86", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_164", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight" + ], + "output": "linear_164", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_137", + "inputs": [ + "linear_164" + ], + "output": "view_137", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_165", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight" + ], + "output": "linear_165", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_166", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight" + ], + "output": "linear_166", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_37", + "inputs": [ + "states_42", + "transpose_86" + ], + "output": "cat_37", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_188", + "inputs": [ + "cat_37" + ], + "output": "slice_188", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_42", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_16", + "inputs": [ + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight" + ], + "output": "squeeze_16", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_40", + "inputs": [ + "squeeze_16" + ], + "output": "unsqueeze_40", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_16", + "inputs": [ + "cat_37", + "unsqueeze_40" + ], + "output": "conv1d_16", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_189", + "inputs": [ + "conv1d_16" + ], + "output": "slice_189", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_53", + "inputs": [ + "slice_189" + ], + "output": "silu_53", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_190", + "inputs": [ + "silu_53" + ], + "output": "slice_190", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_87", + "inputs": [ + "slice_190" + ], + "output": "transpose_87", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_191", + "inputs": [ + "transpose_87" + ], + "output": "slice_191", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_192", + "inputs": [ + "transpose_87" + ], + "output": "slice_192", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_193", + "inputs": [ + "transpose_87" + ], + "output": "slice_193", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_138", + "inputs": [ + "slice_191" + ], + "output": "view_138", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_139", + "inputs": [ + "slice_192" + ], + "output": "view_139", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_140", + "inputs": [ + "slice_193" + ], + "output": "view_140", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_21", + "inputs": [ + "linear_165" + ], + "output": "sigmoid_21", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_16", + "inputs": [ + "p_model_model_language_model_layers_21_linear_attn_a_log" + ], + "output": "exp_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_26", + "inputs": [ + "exp_16" + ], + "output": "neg_26", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_227", + "inputs": [ + "linear_166", + "p_model_model_language_model_layers_21_linear_attn_dt_bias" + ], + "output": "add_227", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_16", + "inputs": [ + "add_227" + ], + "output": "softplus_16", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_287", + "inputs": [ + "neg_26", + "softplus_16" + ], + "output": "mul_287", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_288", + "inputs": [ + "view_138" + ], + "output": "mul_288", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_33", + "inputs": [ + "mul_288" + ], + "output": "sum_33", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_228", + "inputs": [ + "sum_33" + ], + "output": "add_228", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_101", + "inputs": [ + "add_228" + ], + "output": "rsqrt_101", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_289", + "inputs": [ + "view_138", + "rsqrt_101" + ], + "output": "mul_289", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_290", + "inputs": [ + "view_139" + ], + "output": "mul_290", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_34", + "inputs": [ + "mul_290" + ], + "output": "sum_34", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_229", + "inputs": [ + "sum_34" + ], + "output": "add_229", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_102", + "inputs": [ + "add_229" + ], + "output": "rsqrt_102", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_291", + "inputs": [ + "view_139", + "rsqrt_102" + ], + "output": "mul_291", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_16", + "inputs": [ + "mul_289", + "mul_291", + "view_140", + "mul_287", + "sigmoid_21", + "states_43" + ], + "output": "normalized_gated_delta_rule_16", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_194", + "inputs": [ + "normalized_gated_delta_rule_16" + ], + "output": "slice_194", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_43", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_195", + "inputs": [ + "normalized_gated_delta_rule_16" + ], + "output": "slice_195", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_88", + "inputs": [ + "slice_195" + ], + "output": "transpose_88", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_36", + "inputs": [ + "transpose_88" + ], + "output": "clone_36", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_141", + "inputs": [ + "clone_36" + ], + "output": "view_141", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_142", + "inputs": [ + "view_137" + ], + "output": "view_142", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_293", + "inputs": [ + "view_141", + "p_model_model_language_model_layers_21_linear_attn_norm_weight" + ], + "output": "mul_293", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_294", + "inputs": [ + "view_142", + "mul_293" + ], + "output": "mul_294", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_143", + "inputs": [ + "mul_294" + ], + "output": "view_143", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_167", + "inputs": [ + "view_143", + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight" + ], + "output": "linear_167", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_231", + "inputs": [ + "add_224", + "linear_167" + ], + "output": "add_231", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_296", + "inputs": [ + "add_231", + "p_model_model_language_model_layers_21_post_attention_layernorm_weight" + ], + "output": "mul_296", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_53", + "inputs": [ + "mul_296" + ], + "output": "type_as_53", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_168", + "inputs": [ + "type_as_53", + "p_model_model_language_model_layers_21_mlp_gate_proj_weight" + ], + "output": "linear_168", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_169", + "inputs": [ + "type_as_53", + "p_model_model_language_model_layers_21_mlp_up_proj_weight" + ], + "output": "linear_169", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_297", + "inputs": [ + "linear_168", + "linear_169" + ], + "output": "mul_297", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_170", + "inputs": [ + "mul_297", + "p_model_model_language_model_layers_21_mlp_down_proj_weight" + ], + "output": "linear_170", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_234", + "inputs": [ + "add_231", + "linear_170" + ], + "output": "add_234", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_299", + "inputs": [ + "add_234", + "p_model_model_language_model_layers_22_input_layernorm_weight" + ], + "output": "mul_299", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_54", + "inputs": [ + "mul_299" + ], + "output": "type_as_54", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_171", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_171", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "transpose_89", + "inputs": [ + "linear_171" + ], + "output": "transpose_89", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a21c6a35532bc26ccfc46df22f98e1592e3b285e3800544c032edf39425bde1a.wgsl" + }, + { + "node": "linear_172", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight" + ], + "output": "linear_172", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "view_144", + "inputs": [ + "linear_172" + ], + "output": "view_144", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_173", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight" + ], + "output": "linear_173", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "linear_174", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight" + ], + "output": "linear_174", + "workgroups": [ + 2, + 2, + 1 + ], + "kernel": "kernels/53e3ac216f0ae3145d66c606c4000249a876dbab48b41877415d9592ee714d8f.wgsl" + }, + { + "node": "cat_38", + "inputs": [ + "states_44", + "transpose_89" + ], + "output": "cat_38", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/5cf28cf1e0aa6d5f0ce563a179880681416b707a70113119e68f1d62dc368c51.wgsl" + }, + { + "node": "slice_196", + "inputs": [ + "cat_38" + ], + "output": "slice_196", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_44", + "kernel": "kernels/99e423f03f9fdfee41f3dcaab73257064ffb2a64110066752208324724505a8b.wgsl" + }, + { + "node": "squeeze_17", + "inputs": [ + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight" + ], + "output": "squeeze_17", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_41", + "inputs": [ + "squeeze_17" + ], + "output": "unsqueeze_41", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_17", + "inputs": [ + "cat_38", + "unsqueeze_41" + ], + "output": "conv1d_17", + "workgroups": [ + 2208, + 1, + 1 + ], + "kernel": "kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl" + }, + { + "node": "slice_197", + "inputs": [ + "conv1d_17" + ], + "output": "slice_197", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/8c2cc45aff0682e734174141c9fcc5edcdac7925ad6128b062befdba21f8695f.wgsl" + }, + { + "node": "silu_56", + "inputs": [ + "slice_197" + ], + "output": "silu_56", + "workgroups": [ + 1920, + 1, + 1 + ], + "kernel": "kernels/9d504391a987c7be7ccfbb7972c27cf54cd62730c19cbe7949fee2ea059f0c43.wgsl" + }, + { + "node": "slice_198", + "inputs": [ + "silu_56" + ], + "output": "slice_198", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/8c92c6f1421c6378452dd1e15eae6d7da76404ac7e9a0b756bace66e6f207d21.wgsl" + }, + { + "node": "transpose_90", + "inputs": [ + "slice_198" + ], + "output": "transpose_90", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/a7b50e8b6e4d56404b6261383f50b3eed4a2a59c3fadaaffcc974575c32a374f.wgsl" + }, + { + "node": "slice_199", + "inputs": [ + "transpose_90" + ], + "output": "slice_199", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c24c7e6057a3ab4778def9751ec5123025ec0e36139db626eccc4a9151bc6cc3.wgsl" + }, + { + "node": "slice_200", + "inputs": [ + "transpose_90" + ], + "output": "slice_200", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/f8460b61ea8ab5946764c8a8fa3a6aa4a51c4db1e30f5f1d3e3f0f2f1635a964.wgsl" + }, + { + "node": "slice_201", + "inputs": [ + "transpose_90" + ], + "output": "slice_201", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/a24673da4fae6d1c49aa143f8425996b2d036db7b0341987dab330c78ead91d7.wgsl" + }, + { + "node": "view_145", + "inputs": [ + "slice_199" + ], + "output": "view_145", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_146", + "inputs": [ + "slice_200" + ], + "output": "view_146", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_147", + "inputs": [ + "slice_201" + ], + "output": "view_147", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_22", + "inputs": [ + "linear_173" + ], + "output": "sigmoid_22", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d2d4993e8058293c7308e58f517619651bbfcfc855acd7e3f5a8cfdfd971dab.wgsl" + }, + { + "node": "exp_17", + "inputs": [ + "p_model_model_language_model_layers_22_linear_attn_a_log" + ], + "output": "exp_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_27", + "inputs": [ + "exp_17" + ], + "output": "neg_27", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_237", + "inputs": [ + "linear_174", + "p_model_model_language_model_layers_22_linear_attn_dt_bias" + ], + "output": "add_237", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/5f9d7a23bba38f692aefbf2617133c7884ddbe4ea6d985a89a59c1683dcfd6bf.wgsl" + }, + { + "node": "softplus_17", + "inputs": [ + "add_237" + ], + "output": "softplus_17", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl" + }, + { + "node": "mul_300", + "inputs": [ + "neg_27", + "softplus_17" + ], + "output": "mul_300", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/c02ac02d110c0be5d0990d20ab0d8c7a081c74f4e147f083789a203f22fc3258.wgsl" + }, + { + "node": "mul_301", + "inputs": [ + "view_145" + ], + "output": "mul_301", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_35", + "inputs": [ + "mul_301" + ], + "output": "sum_35", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_238", + "inputs": [ + "sum_35" + ], + "output": "add_238", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_106", + "inputs": [ + "add_238" + ], + "output": "rsqrt_106", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_302", + "inputs": [ + "view_145", + "rsqrt_106" + ], + "output": "mul_302", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "mul_303", + "inputs": [ + "view_146" + ], + "output": "mul_303", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/237458dff084b2aa9ccba5578da3b2a0b062951575364d1464250baca3fdac5a.wgsl" + }, + { + "node": "sum_36", + "inputs": [ + "mul_303" + ], + "output": "sum_36", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8d924efe3620ed999f0cf4e6adc1df91b7def10b99b5ecb839ceaa662b43c82c.wgsl" + }, + { + "node": "add_239", + "inputs": [ + "sum_36" + ], + "output": "add_239", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/73b861456466f63d096073357cb34eb5f5819861a2961838b6590969f894fa95.wgsl" + }, + { + "node": "rsqrt_107", + "inputs": [ + "add_239" + ], + "output": "rsqrt_107", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl" + }, + { + "node": "mul_304", + "inputs": [ + "view_146", + "rsqrt_107" + ], + "output": "mul_304", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/793acab25c53175e48dbfd1019e7c5f2bd0176d97e2134d7c290a66cfe702c34.wgsl" + }, + { + "node": "normalized_gated_delta_rule_17", + "inputs": [ + "mul_302", + "mul_304", + "view_147", + "mul_300", + "sigmoid_22", + "states_45" + ], + "output": "normalized_gated_delta_rule_17", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/4d05b472f8cb3485606d782585e1061973f1391d129fb765f9cb0f38c5fbb433.wgsl" + }, + { + "node": "slice_202", + "inputs": [ + "normalized_gated_delta_rule_17" + ], + "output": "slice_202", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_45", + "kernel": "kernels/466959b3cf0d274924151bdd80808e8451f9d8c2aac1455a44f26fa6d8b44fd0.wgsl" + }, + { + "node": "slice_203", + "inputs": [ + "normalized_gated_delta_rule_17" + ], + "output": "slice_203", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/7f684886a0c031e32c9cf7a4bff880ae692ddc08ddca971ee20d728b4736d0da.wgsl" + }, + { + "node": "transpose_91", + "inputs": [ + "slice_203" + ], + "output": "transpose_91", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/52210a661e4d5241f53b3b1caf65456e1988ddd663ded8ead63ee7f7c7e3ff57.wgsl" + }, + { + "node": "clone_37", + "inputs": [ + "transpose_91" + ], + "output": "clone_37", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_148", + "inputs": [ + "clone_37" + ], + "output": "view_148", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_149", + "inputs": [ + "view_144" + ], + "output": "view_149", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_306", + "inputs": [ + "view_148", + "p_model_model_language_model_layers_22_linear_attn_norm_weight" + ], + "output": "mul_306", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/5a3a2ba3e1cb848fbbeeafe66425eae65d9fd196646d15eef291188a8179e044.wgsl" + }, + { + "node": "mul_307", + "inputs": [ + "view_149", + "mul_306" + ], + "output": "mul_307", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/6de6505af6ba3c1c020424d3a99773ff62d2308a2fbf2295ec2ea7e919e4cbb9.wgsl" + }, + { + "node": "view_150", + "inputs": [ + "mul_307" + ], + "output": "view_150", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_175", + "inputs": [ + "view_150", + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight" + ], + "output": "linear_175", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_241", + "inputs": [ + "add_234", + "linear_175" + ], + "output": "add_241", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_309", + "inputs": [ + "add_241", + "p_model_model_language_model_layers_22_post_attention_layernorm_weight" + ], + "output": "mul_309", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_55", + "inputs": [ + "mul_309" + ], + "output": "type_as_55", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_176", + "inputs": [ + "type_as_55", + "p_model_model_language_model_layers_22_mlp_gate_proj_weight" + ], + "output": "linear_176", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_177", + "inputs": [ + "type_as_55", + "p_model_model_language_model_layers_22_mlp_up_proj_weight" + ], + "output": "linear_177", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_310", + "inputs": [ + "linear_176", + "linear_177" + ], + "output": "mul_310", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_178", + "inputs": [ + "mul_310", + "p_model_model_language_model_layers_22_mlp_down_proj_weight" + ], + "output": "linear_178", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_244", + "inputs": [ + "add_241", + "linear_178" + ], + "output": "add_244", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_312", + "inputs": [ + "add_244", + "p_model_model_language_model_layers_23_input_layernorm_weight" + ], + "output": "mul_312", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_56", + "inputs": [ + "mul_312" + ], + "output": "type_as_56", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_179", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_q_proj_weight" + ], + "output": "linear_179", + "workgroups": [ + 512, + 2, + 1 + ], + "kernel": "kernels/4e0fada2b6f07e141f088694ab936356f2c70b66fb98e95e537c2c9d7ffb518a.wgsl" + }, + { + "node": "view_151", + "inputs": [ + "linear_179" + ], + "output": "view_151", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/aac6395f039e396767ee10d0ad95d3d6206ad4a5c1e5913dfd5c3cfeaf227510.wgsl" + }, + { + "node": "slice_204", + "inputs": [ + "view_151" + ], + "output": "slice_204", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/9d3d7b777701cd320ca11358e554e1019fb041ee4d765e66071c215242906773.wgsl" + }, + { + "node": "slice_205", + "inputs": [ + "view_151" + ], + "output": "slice_205", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/3622ffa2072335a35d6c9db5d284ed92b3fb5ed304acc2c606408063e7e21dcd.wgsl" + }, + { + "node": "clone_38", + "inputs": [ + "slice_205" + ], + "output": "clone_38", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "_unsafe_view_15", + "inputs": [ + "clone_38" + ], + "output": "_unsafe_view_15", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_152", + "inputs": [ + "slice_204" + ], + "output": "view_152", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_314", + "inputs": [ + "view_152", + "p_model_model_language_model_layers_23_self_attn_q_norm_weight" + ], + "output": "mul_314", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_57", + "inputs": [ + "mul_314" + ], + "output": "type_as_57", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_92", + "inputs": [ + "type_as_57" + ], + "output": "transpose_92", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/63396da046b345383e1c7b09aee551d08e4c3c45030ff5c8bb76bbc34bb2abc6.wgsl" + }, + { + "node": "linear_180", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_k_proj_weight" + ], + "output": "linear_180", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_153", + "inputs": [ + "linear_180" + ], + "output": "view_153", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_316", + "inputs": [ + "view_153", + "p_model_model_language_model_layers_23_self_attn_k_norm_weight" + ], + "output": "mul_316", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_58", + "inputs": [ + "mul_316" + ], + "output": "type_as_58", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_93", + "inputs": [ + "type_as_58" + ], + "output": "transpose_93", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "linear_181", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_v_proj_weight" + ], + "output": "linear_181", + "workgroups": [ + 64, + 2, + 1 + ], + "kernel": "kernels/fe8df26d9dca2aca6a22429dd9ab2c28acaba4e0caac80bf83ea8683b267ff25.wgsl" + }, + { + "node": "view_154", + "inputs": [ + "linear_181" + ], + "output": "view_154", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_94", + "inputs": [ + "view_154" + ], + "output": "transpose_94", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6c57b74ac00a3e385675c024ab180b06a05158dcda1371891249af95792f27fc.wgsl" + }, + { + "node": "unsqueeze_42", + "inputs": [ + "mul" + ], + "output": "unsqueeze_42", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "unsqueeze_43", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_43", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl" + }, + { + "node": "slice_206", + "inputs": [ + "transpose_92" + ], + "output": "slice_206", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f2ee90b3d949141c23610237d27d44a7b833aacae8cdbc2e42a595d5eb7b5537.wgsl" + }, + { + "node": "slice_207", + "inputs": [ + "transpose_92" + ], + "output": "slice_207", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8d62df48089497dd19fea48680730210decda42b63f69ecdf9688fc4a43efc58.wgsl" + }, + { + "node": "slice_208", + "inputs": [ + "transpose_93" + ], + "output": "slice_208", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/6caa35fcab56c639d1859e1b090a7e5bf016dd7f33ecd2373c24ab625de16e09.wgsl" + }, + { + "node": "slice_209", + "inputs": [ + "transpose_93" + ], + "output": "slice_209", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl" + }, + { + "node": "mul_317", + "inputs": [ + "slice_206", + "unsqueeze_42" + ], + "output": "mul_317", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "slice_210", + "inputs": [ + "slice_206" + ], + "output": "slice_210", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/b5984ff6eb9e56ef0f9930f775c1dc3c203eec15924e5fea4c2525b2ce180857.wgsl" + }, + { + "node": "slice_211", + "inputs": [ + "slice_206" + ], + "output": "slice_211", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/8256ea6cdc3500306470c0bb2dcdb44ebdd454dafa218ad6a94dd953b9bbe125.wgsl" + }, + { + "node": "neg_28", + "inputs": [ + "slice_211" + ], + "output": "neg_28", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_39", + "inputs": [ + "neg_28", + "slice_210" + ], + "output": "cat_39", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_318", + "inputs": [ + "cat_39", + "unsqueeze_43" + ], + "output": "mul_318", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e3c6a64e01b6ea79adf125ff00a6dcf00f0b65aee0f4a3d14fdbc20e5dfeb22d.wgsl" + }, + { + "node": "add_251", + "inputs": [ + "mul_317", + "mul_318" + ], + "output": "add_251", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_319", + "inputs": [ + "slice_208", + "unsqueeze_42" + ], + "output": "mul_319", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "slice_212", + "inputs": [ + "slice_208" + ], + "output": "slice_212", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/58077eb80a5fa253f535c97c82dc07edd48455a17cc52583aeee41c7d1bbd0b3.wgsl" + }, + { + "node": "slice_213", + "inputs": [ + "slice_208" + ], + "output": "slice_213", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/3830061b0fc54c85d3d8a783b927c44484b1a3b68b52b8d8a1b980f7553deebf.wgsl" + }, + { + "node": "neg_29", + "inputs": [ + "slice_213" + ], + "output": "neg_29", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_40", + "inputs": [ + "neg_29", + "slice_212" + ], + "output": "cat_40", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_320", + "inputs": [ + "cat_40", + "unsqueeze_43" + ], + "output": "mul_320", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl" + }, + { + "node": "add_252", + "inputs": [ + "mul_319", + "mul_320" + ], + "output": "add_252", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "cat_41", + "inputs": [ + "add_251", + "slice_207" + ], + "output": "cat_41", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cat_42", + "inputs": [ + "add_252", + "slice_209" + ], + "output": "cat_42", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cache_update_10", + "inputs": [ + "cat_42", + "cache_position" + ], + "output": "cache_update_10", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_46", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "cache_update_11", + "inputs": [ + "transpose_94", + "cache_position" + ], + "output": "cache_update_11", + "workgroups": [ + 128, + 1, + 1 + ], + "inPlaceOf": "states_47", + "kernel": "kernels/6d748fa04b83886e523f4d9b826e6865f73b31dfe31385b10bd0b9cc9ec4d1db.wgsl" + }, + { + "node": "unsqueeze_44", + "inputs": [ + "cache_update_10" + ], + "output": "unsqueeze_44", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_11", + "inputs": [ + "unsqueeze_44" + ], + "output": "expand_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_39", + "inputs": [ + "expand_11" + ], + "output": "clone_39", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_16", + "inputs": [ + "clone_39" + ], + "output": "_unsafe_view_16", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_45", + "inputs": [ + "cache_update_11" + ], + "output": "unsqueeze_45", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_12", + "inputs": [ + "unsqueeze_45" + ], + "output": "expand_12", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_40", + "inputs": [ + "expand_12" + ], + "output": "clone_40", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_17", + "inputs": [ + "clone_40" + ], + "output": "_unsafe_view_17", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_95", + "inputs": [ + "_unsafe_view_16" + ], + "output": "transpose_95", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_11", + "inputs": [ + "cat_41", + "transpose_95" + ], + "output": "matmul_11", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/56ea85fd6d5f7cc9394d6aa0ee2fdeee921dc84957548088041c975ba925c6a0.wgsl" + }, + { + "node": "mul_321", + "inputs": [ + "matmul_11" + ], + "output": "mul_321", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl" + }, + { + "node": "add_253", + "inputs": [ + "mul_321", + "attention_mask" + ], + "output": "add_253", + "workgroups": [ + 8192, + 1, + 1 + ], + "kernel": "kernels/2e6f807cdf7ba91d7f531d9fb37768171ca71dc6278a9863bdba4a3dbac34fb3.wgsl" + }, + { + "node": "softmax_5", + "inputs": [ + "add_253" + ], + "output": "softmax_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e0811c2ada7eb4498201ac912dc9198cdd5f5904d94b2caa1b7a37e7bd9dc030.wgsl" + }, + { + "node": "matmul_12", + "inputs": [ + "softmax_5", + "_unsafe_view_17" + ], + "output": "matmul_12", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ac61ff8b1e3d15ef1f43e9d610e97d84fcae08527ed0a992d3cebbce5fdd286a.wgsl" + }, + { + "node": "transpose_96", + "inputs": [ + "matmul_12" + ], + "output": "transpose_96", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/84f24861effe9e2f3b05f98fe6d4e16f4f8204be40a7eeece0668e57060ecc7b.wgsl" + }, + { + "node": "clone_41", + "inputs": [ + "transpose_96" + ], + "output": "clone_41", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "view_155", + "inputs": [ + "clone_41" + ], + "output": "view_155", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "sigmoid_23", + "inputs": [ + "_unsafe_view_15" + ], + "output": "sigmoid_23", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/816861e23c92e156c1ac01f21e4f6dd1cbfc14978b1be8a5994fb45b0f845cb8.wgsl" + }, + { + "node": "mul_322", + "inputs": [ + "view_155", + "sigmoid_23" + ], + "output": "mul_322", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/aa227ae49fab3f75d86e02e6f390be785eabfeafe70e77a5c7eb4ad51895e382.wgsl" + }, + { + "node": "linear_182", + "inputs": [ + "mul_322", + "p_model_model_language_model_layers_23_self_attn_o_proj_weight" + ], + "output": "linear_182", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/de637d523e83fc454a935515d5d0b5fd029fe23bb9dcd734e82e682fd741b32d.wgsl" + }, + { + "node": "add_254", + "inputs": [ + "add_244", + "linear_182" + ], + "output": "add_254", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_324", + "inputs": [ + "add_254", + "p_model_model_language_model_layers_23_post_attention_layernorm_weight" + ], + "output": "mul_324", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_59", + "inputs": [ + "mul_324" + ], + "output": "type_as_59", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_183", + "inputs": [ + "type_as_59", + "p_model_model_language_model_layers_23_mlp_gate_proj_weight" + ], + "output": "linear_183", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "linear_184", + "inputs": [ + "type_as_59", + "p_model_model_language_model_layers_23_mlp_up_proj_weight" + ], + "output": "linear_184", + "workgroups": [ + 768, + 2, + 1 + ], + "kernel": "kernels/431cc9474b62045f7fbd61f4bac639636753584f37b063a6213820c11612fa3d.wgsl" + }, + { + "node": "mul_325", + "inputs": [ + "linear_183", + "linear_184" + ], + "output": "mul_325", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/2505a613f10a5ed1c70a3f80a16dd566da65caa2d7d85083e23f85a30844d63e.wgsl" + }, + { + "node": "linear_185", + "inputs": [ + "mul_325", + "p_model_model_language_model_layers_23_mlp_down_proj_weight" + ], + "output": "linear_185", + "workgroups": [ + 256, + 2, + 1 + ], + "kernel": "kernels/3d4359c4f1d0d65e6b6049b73a4e3f5fb67573fb80e29c9321f3671f40786f65.wgsl" + }, + { + "node": "add_257", + "inputs": [ + "add_254", + "linear_185" + ], + "output": "add_257", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_327", + "inputs": [ + "add_257", + "p_model_model_language_model_norm_weight" + ], + "output": "mul_327", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8e3d3b82b0e50fa7a86f44f30fe70b1ee226e613ce06b69776f5624efb029235.wgsl" + }, + { + "node": "type_as_60", + "inputs": [ + "mul_327" + ], + "output": "type_as_60", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "alias", + "inputs": [ + "type_as_60" + ], + "output": "alias", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "linear_186__part_0", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_0_32768" + ], + "output": "linear_186__part_0", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_1", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768" + ], + "output": "linear_186__part_1", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_2", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768" + ], + "output": "linear_186__part_2", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_3", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768" + ], + "output": "linear_186__part_3", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_4", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768" + ], + "output": "linear_186__part_4", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_5", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768" + ], + "output": "linear_186__part_5", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_6", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768" + ], + "output": "linear_186__part_6", + "workgroups": [ + 4096, + 2, + 1 + ], + "kernel": "kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl" + }, + { + "node": "linear_186__part_7", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944" + ], + "output": "linear_186__part_7", + "workgroups": [ + 2368, + 2, + 1 + ], + "kernel": "kernels/58a04f81024c554fa7384cf7989536e51ab65a353203039f95c9787453ee627c.wgsl" + }, + { + "node": "linear_186__cat_0_0", + "inputs": [ + "linear_186__part_0", + "linear_186__part_1", + "linear_186__part_2", + "linear_186__part_3", + "linear_186__part_4", + "linear_186__part_5", + "linear_186__part_6" + ], + "output": "linear_186__cat_0_0", + "workgroups": [ + 57344, + 1, + 1 + ], + "kernel": "kernels/36c55d910d6fdaf8d3a2bba5a559bf7dcf54364986a7f2c0610b523600667d91.wgsl" + }, + { + "node": "linear_186__cat_0_7", + "inputs": [ + "linear_186__part_7" + ], + "output": "linear_186__cat_0_7", + "workgroups": [ + 4736, + 1, + 1 + ], + "kernel": "kernels/b64a63c60f91d717d7879df834c3443b1675c875093fad7b05da47fac5d61fc4.wgsl" + }, + { + "node": "linear_186", + "inputs": [ + "linear_186__cat_0_0", + "linear_186__cat_0_7" + ], + "output": "linear_186", + "workgroups": [ + 62080, + 1, + 1 + ], + "kernel": "kernels/2c81f71954e9a2503ae8f3d84f319ffe366cdbb428ab45c22bddee91751c035c.wgsl" + } + ], + "memory": { + "slots": [ + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 128, + 64, + 256, + 262144, + 131072, + 64, + 64, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 77594624, + 131072, + 131072, + 131072, + 131072, + 131072, + 131072, + 131072, + 131072, + 131072, + 393216, + 393216, + 491520, + 565248, + 1179648, + 16384, + 16384, + 32768, + 8388608, + 33554432, + 33554432, + 33554432, + 2097152, + 2097152, + 2097152, + 1212416, + 14680064 + ], + "assignment": { + "p_model_model_language_model_layers_0_input_layernorm_weight": 0, + "p_model_model_language_model_layers_0_linear_attn_a_log": 1, + "p_model_model_language_model_layers_0_linear_attn_dt_bias": 2, + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight": 3, + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight": 4, + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight": 5, + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight": 6, + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight": 7, + "p_model_model_language_model_layers_0_linear_attn_norm_weight": 8, + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight": 9, + "p_model_model_language_model_layers_0_post_attention_layernorm_weight": 10, + "p_model_model_language_model_layers_0_mlp_gate_proj_weight": 11, + "p_model_model_language_model_layers_0_mlp_up_proj_weight": 12, + "p_model_model_language_model_layers_0_mlp_down_proj_weight": 13, + "p_model_model_language_model_layers_1_input_layernorm_weight": 14, + "p_model_model_language_model_layers_1_linear_attn_a_log": 15, + "p_model_model_language_model_layers_1_linear_attn_dt_bias": 16, + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight": 17, + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight": 18, + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight": 19, + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight": 20, + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight": 21, + "p_model_model_language_model_layers_1_linear_attn_norm_weight": 22, + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight": 23, + "p_model_model_language_model_layers_1_post_attention_layernorm_weight": 24, + "p_model_model_language_model_layers_1_mlp_gate_proj_weight": 25, + "p_model_model_language_model_layers_1_mlp_up_proj_weight": 26, + "p_model_model_language_model_layers_1_mlp_down_proj_weight": 27, + "p_model_model_language_model_layers_2_input_layernorm_weight": 28, + "p_model_model_language_model_layers_2_linear_attn_a_log": 29, + "p_model_model_language_model_layers_2_linear_attn_dt_bias": 30, + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight": 31, + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight": 32, + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight": 33, + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight": 34, + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight": 35, + "p_model_model_language_model_layers_2_linear_attn_norm_weight": 36, + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight": 37, + "p_model_model_language_model_layers_2_post_attention_layernorm_weight": 38, + "p_model_model_language_model_layers_2_mlp_gate_proj_weight": 39, + "p_model_model_language_model_layers_2_mlp_up_proj_weight": 40, + "p_model_model_language_model_layers_2_mlp_down_proj_weight": 41, + "p_model_model_language_model_layers_3_input_layernorm_weight": 42, + "p_model_model_language_model_layers_3_self_attn_q_proj_weight": 43, + "p_model_model_language_model_layers_3_self_attn_q_norm_weight": 44, + "p_model_model_language_model_layers_3_self_attn_k_proj_weight": 45, + "p_model_model_language_model_layers_3_self_attn_k_norm_weight": 46, + "p_model_model_language_model_layers_3_self_attn_v_proj_weight": 47, + "p_model_model_language_model_layers_3_self_attn_o_proj_weight": 48, + "p_model_model_language_model_layers_3_post_attention_layernorm_weight": 49, + "p_model_model_language_model_layers_3_mlp_gate_proj_weight": 50, + "p_model_model_language_model_layers_3_mlp_up_proj_weight": 51, + "p_model_model_language_model_layers_3_mlp_down_proj_weight": 52, + "p_model_model_language_model_layers_4_input_layernorm_weight": 53, + "p_model_model_language_model_layers_4_linear_attn_a_log": 54, + "p_model_model_language_model_layers_4_linear_attn_dt_bias": 55, + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight": 56, + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight": 57, + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight": 58, + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight": 59, + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight": 60, + "p_model_model_language_model_layers_4_linear_attn_norm_weight": 61, + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight": 62, + "p_model_model_language_model_layers_4_post_attention_layernorm_weight": 63, + "p_model_model_language_model_layers_4_mlp_gate_proj_weight": 64, + "p_model_model_language_model_layers_4_mlp_up_proj_weight": 65, + "p_model_model_language_model_layers_4_mlp_down_proj_weight": 66, + "p_model_model_language_model_layers_5_input_layernorm_weight": 67, + "p_model_model_language_model_layers_5_linear_attn_a_log": 68, + "p_model_model_language_model_layers_5_linear_attn_dt_bias": 69, + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight": 70, + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight": 71, + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight": 72, + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight": 73, + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight": 74, + "p_model_model_language_model_layers_5_linear_attn_norm_weight": 75, + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight": 76, + "p_model_model_language_model_layers_5_post_attention_layernorm_weight": 77, + "p_model_model_language_model_layers_5_mlp_gate_proj_weight": 78, + "p_model_model_language_model_layers_5_mlp_up_proj_weight": 79, + "p_model_model_language_model_layers_5_mlp_down_proj_weight": 80, + "p_model_model_language_model_layers_6_input_layernorm_weight": 81, + "p_model_model_language_model_layers_6_linear_attn_a_log": 82, + "p_model_model_language_model_layers_6_linear_attn_dt_bias": 83, + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight": 84, + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight": 85, + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight": 86, + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight": 87, + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight": 88, + "p_model_model_language_model_layers_6_linear_attn_norm_weight": 89, + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight": 90, + "p_model_model_language_model_layers_6_post_attention_layernorm_weight": 91, + "p_model_model_language_model_layers_6_mlp_gate_proj_weight": 92, + "p_model_model_language_model_layers_6_mlp_up_proj_weight": 93, + "p_model_model_language_model_layers_6_mlp_down_proj_weight": 94, + "p_model_model_language_model_layers_7_input_layernorm_weight": 95, + "p_model_model_language_model_layers_7_self_attn_q_proj_weight": 96, + "p_model_model_language_model_layers_7_self_attn_q_norm_weight": 97, + "p_model_model_language_model_layers_7_self_attn_k_proj_weight": 98, + "p_model_model_language_model_layers_7_self_attn_k_norm_weight": 99, + "p_model_model_language_model_layers_7_self_attn_v_proj_weight": 100, + "p_model_model_language_model_layers_7_self_attn_o_proj_weight": 101, + "p_model_model_language_model_layers_7_post_attention_layernorm_weight": 102, + "p_model_model_language_model_layers_7_mlp_gate_proj_weight": 103, + "p_model_model_language_model_layers_7_mlp_up_proj_weight": 104, + "p_model_model_language_model_layers_7_mlp_down_proj_weight": 105, + "p_model_model_language_model_layers_8_input_layernorm_weight": 106, + "p_model_model_language_model_layers_8_linear_attn_a_log": 107, + "p_model_model_language_model_layers_8_linear_attn_dt_bias": 108, + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight": 109, + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight": 110, + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight": 111, + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight": 112, + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight": 113, + "p_model_model_language_model_layers_8_linear_attn_norm_weight": 114, + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight": 115, + "p_model_model_language_model_layers_8_post_attention_layernorm_weight": 116, + "p_model_model_language_model_layers_8_mlp_gate_proj_weight": 117, + "p_model_model_language_model_layers_8_mlp_up_proj_weight": 118, + "p_model_model_language_model_layers_8_mlp_down_proj_weight": 119, + "p_model_model_language_model_layers_9_input_layernorm_weight": 120, + "p_model_model_language_model_layers_9_linear_attn_a_log": 121, + "p_model_model_language_model_layers_9_linear_attn_dt_bias": 122, + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight": 123, + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight": 124, + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight": 125, + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight": 126, + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight": 127, + "p_model_model_language_model_layers_9_linear_attn_norm_weight": 128, + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight": 129, + "p_model_model_language_model_layers_9_post_attention_layernorm_weight": 130, + "p_model_model_language_model_layers_9_mlp_gate_proj_weight": 131, + "p_model_model_language_model_layers_9_mlp_up_proj_weight": 132, + "p_model_model_language_model_layers_9_mlp_down_proj_weight": 133, + "p_model_model_language_model_layers_10_input_layernorm_weight": 134, + "p_model_model_language_model_layers_10_linear_attn_a_log": 135, + "p_model_model_language_model_layers_10_linear_attn_dt_bias": 136, + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight": 137, + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight": 138, + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight": 139, + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight": 140, + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight": 141, + "p_model_model_language_model_layers_10_linear_attn_norm_weight": 142, + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight": 143, + "p_model_model_language_model_layers_10_post_attention_layernorm_weight": 144, + "p_model_model_language_model_layers_10_mlp_gate_proj_weight": 145, + "p_model_model_language_model_layers_10_mlp_up_proj_weight": 146, + "p_model_model_language_model_layers_10_mlp_down_proj_weight": 147, + "p_model_model_language_model_layers_11_input_layernorm_weight": 148, + "p_model_model_language_model_layers_11_self_attn_q_proj_weight": 149, + "p_model_model_language_model_layers_11_self_attn_q_norm_weight": 150, + "p_model_model_language_model_layers_11_self_attn_k_proj_weight": 151, + "p_model_model_language_model_layers_11_self_attn_k_norm_weight": 152, + "p_model_model_language_model_layers_11_self_attn_v_proj_weight": 153, + "p_model_model_language_model_layers_11_self_attn_o_proj_weight": 154, + "p_model_model_language_model_layers_11_post_attention_layernorm_weight": 155, + "p_model_model_language_model_layers_11_mlp_gate_proj_weight": 156, + "p_model_model_language_model_layers_11_mlp_up_proj_weight": 157, + "p_model_model_language_model_layers_11_mlp_down_proj_weight": 158, + "p_model_model_language_model_layers_12_input_layernorm_weight": 159, + "p_model_model_language_model_layers_12_linear_attn_a_log": 160, + "p_model_model_language_model_layers_12_linear_attn_dt_bias": 161, + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight": 162, + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight": 163, + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight": 164, + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight": 165, + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight": 166, + "p_model_model_language_model_layers_12_linear_attn_norm_weight": 167, + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight": 168, + "p_model_model_language_model_layers_12_post_attention_layernorm_weight": 169, + "p_model_model_language_model_layers_12_mlp_gate_proj_weight": 170, + "p_model_model_language_model_layers_12_mlp_up_proj_weight": 171, + "p_model_model_language_model_layers_12_mlp_down_proj_weight": 172, + "p_model_model_language_model_layers_13_input_layernorm_weight": 173, + "p_model_model_language_model_layers_13_linear_attn_a_log": 174, + "p_model_model_language_model_layers_13_linear_attn_dt_bias": 175, + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight": 176, + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight": 177, + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight": 178, + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight": 179, + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight": 180, + "p_model_model_language_model_layers_13_linear_attn_norm_weight": 181, + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight": 182, + "p_model_model_language_model_layers_13_post_attention_layernorm_weight": 183, + "p_model_model_language_model_layers_13_mlp_gate_proj_weight": 184, + "p_model_model_language_model_layers_13_mlp_up_proj_weight": 185, + "p_model_model_language_model_layers_13_mlp_down_proj_weight": 186, + "p_model_model_language_model_layers_14_input_layernorm_weight": 187, + "p_model_model_language_model_layers_14_linear_attn_a_log": 188, + "p_model_model_language_model_layers_14_linear_attn_dt_bias": 189, + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight": 190, + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight": 191, + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight": 192, + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight": 193, + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight": 194, + "p_model_model_language_model_layers_14_linear_attn_norm_weight": 195, + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight": 196, + "p_model_model_language_model_layers_14_post_attention_layernorm_weight": 197, + "p_model_model_language_model_layers_14_mlp_gate_proj_weight": 198, + "p_model_model_language_model_layers_14_mlp_up_proj_weight": 199, + "p_model_model_language_model_layers_14_mlp_down_proj_weight": 200, + "p_model_model_language_model_layers_15_input_layernorm_weight": 201, + "p_model_model_language_model_layers_15_self_attn_q_proj_weight": 202, + "p_model_model_language_model_layers_15_self_attn_q_norm_weight": 203, + "p_model_model_language_model_layers_15_self_attn_k_proj_weight": 204, + "p_model_model_language_model_layers_15_self_attn_k_norm_weight": 205, + "p_model_model_language_model_layers_15_self_attn_v_proj_weight": 206, + "p_model_model_language_model_layers_15_self_attn_o_proj_weight": 207, + "p_model_model_language_model_layers_15_post_attention_layernorm_weight": 208, + "p_model_model_language_model_layers_15_mlp_gate_proj_weight": 209, + "p_model_model_language_model_layers_15_mlp_up_proj_weight": 210, + "p_model_model_language_model_layers_15_mlp_down_proj_weight": 211, + "p_model_model_language_model_layers_16_input_layernorm_weight": 212, + "p_model_model_language_model_layers_16_linear_attn_a_log": 213, + "p_model_model_language_model_layers_16_linear_attn_dt_bias": 214, + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight": 215, + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight": 216, + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight": 217, + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight": 218, + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight": 219, + "p_model_model_language_model_layers_16_linear_attn_norm_weight": 220, + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight": 221, + "p_model_model_language_model_layers_16_post_attention_layernorm_weight": 222, + "p_model_model_language_model_layers_16_mlp_gate_proj_weight": 223, + "p_model_model_language_model_layers_16_mlp_up_proj_weight": 224, + "p_model_model_language_model_layers_16_mlp_down_proj_weight": 225, + "p_model_model_language_model_layers_17_input_layernorm_weight": 226, + "p_model_model_language_model_layers_17_linear_attn_a_log": 227, + "p_model_model_language_model_layers_17_linear_attn_dt_bias": 228, + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight": 229, + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight": 230, + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight": 231, + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight": 232, + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight": 233, + "p_model_model_language_model_layers_17_linear_attn_norm_weight": 234, + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight": 235, + "p_model_model_language_model_layers_17_post_attention_layernorm_weight": 236, + "p_model_model_language_model_layers_17_mlp_gate_proj_weight": 237, + "p_model_model_language_model_layers_17_mlp_up_proj_weight": 238, + "p_model_model_language_model_layers_17_mlp_down_proj_weight": 239, + "p_model_model_language_model_layers_18_input_layernorm_weight": 240, + "p_model_model_language_model_layers_18_linear_attn_a_log": 241, + "p_model_model_language_model_layers_18_linear_attn_dt_bias": 242, + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight": 243, + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight": 244, + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight": 245, + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight": 246, + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight": 247, + "p_model_model_language_model_layers_18_linear_attn_norm_weight": 248, + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight": 249, + "p_model_model_language_model_layers_18_post_attention_layernorm_weight": 250, + "p_model_model_language_model_layers_18_mlp_gate_proj_weight": 251, + "p_model_model_language_model_layers_18_mlp_up_proj_weight": 252, + "p_model_model_language_model_layers_18_mlp_down_proj_weight": 253, + "p_model_model_language_model_layers_19_input_layernorm_weight": 254, + "p_model_model_language_model_layers_19_self_attn_q_proj_weight": 255, + "p_model_model_language_model_layers_19_self_attn_q_norm_weight": 256, + "p_model_model_language_model_layers_19_self_attn_k_proj_weight": 257, + "p_model_model_language_model_layers_19_self_attn_k_norm_weight": 258, + "p_model_model_language_model_layers_19_self_attn_v_proj_weight": 259, + "p_model_model_language_model_layers_19_self_attn_o_proj_weight": 260, + "p_model_model_language_model_layers_19_post_attention_layernorm_weight": 261, + "p_model_model_language_model_layers_19_mlp_gate_proj_weight": 262, + "p_model_model_language_model_layers_19_mlp_up_proj_weight": 263, + "p_model_model_language_model_layers_19_mlp_down_proj_weight": 264, + "p_model_model_language_model_layers_20_input_layernorm_weight": 265, + "p_model_model_language_model_layers_20_linear_attn_a_log": 266, + "p_model_model_language_model_layers_20_linear_attn_dt_bias": 267, + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight": 268, + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight": 269, + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight": 270, + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight": 271, + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight": 272, + "p_model_model_language_model_layers_20_linear_attn_norm_weight": 273, + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight": 274, + "p_model_model_language_model_layers_20_post_attention_layernorm_weight": 275, + "p_model_model_language_model_layers_20_mlp_gate_proj_weight": 276, + "p_model_model_language_model_layers_20_mlp_up_proj_weight": 277, + "p_model_model_language_model_layers_20_mlp_down_proj_weight": 278, + "p_model_model_language_model_layers_21_input_layernorm_weight": 279, + "p_model_model_language_model_layers_21_linear_attn_a_log": 280, + "p_model_model_language_model_layers_21_linear_attn_dt_bias": 281, + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight": 282, + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight": 283, + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight": 284, + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight": 285, + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight": 286, + "p_model_model_language_model_layers_21_linear_attn_norm_weight": 287, + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight": 288, + "p_model_model_language_model_layers_21_post_attention_layernorm_weight": 289, + "p_model_model_language_model_layers_21_mlp_gate_proj_weight": 290, + "p_model_model_language_model_layers_21_mlp_up_proj_weight": 291, + "p_model_model_language_model_layers_21_mlp_down_proj_weight": 292, + "p_model_model_language_model_layers_22_input_layernorm_weight": 293, + "p_model_model_language_model_layers_22_linear_attn_a_log": 294, + "p_model_model_language_model_layers_22_linear_attn_dt_bias": 295, + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight": 296, + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight": 297, + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight": 298, + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight": 299, + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight": 300, + "p_model_model_language_model_layers_22_linear_attn_norm_weight": 301, + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight": 302, + "p_model_model_language_model_layers_22_post_attention_layernorm_weight": 303, + "p_model_model_language_model_layers_22_mlp_gate_proj_weight": 304, + "p_model_model_language_model_layers_22_mlp_up_proj_weight": 305, + "p_model_model_language_model_layers_22_mlp_down_proj_weight": 306, + "p_model_model_language_model_layers_23_input_layernorm_weight": 307, + "p_model_model_language_model_layers_23_self_attn_q_proj_weight": 308, + "p_model_model_language_model_layers_23_self_attn_q_norm_weight": 309, + "p_model_model_language_model_layers_23_self_attn_k_proj_weight": 310, + "p_model_model_language_model_layers_23_self_attn_k_norm_weight": 311, + "p_model_model_language_model_layers_23_self_attn_v_proj_weight": 312, + "p_model_model_language_model_layers_23_self_attn_o_proj_weight": 313, + "p_model_model_language_model_layers_23_post_attention_layernorm_weight": 314, + "p_model_model_language_model_layers_23_mlp_gate_proj_weight": 315, + "p_model_model_language_model_layers_23_mlp_up_proj_weight": 316, + "p_model_model_language_model_layers_23_mlp_down_proj_weight": 317, + "p_model_model_language_model_norm_weight": 318, + "b_model_model_language_model_rotary_emb_inv_freq": 319, + "input_ids": 320, + "position_ids": 321, + "attention_mask": 322, + "image_embedding": 323, + "is_image": 324, + "cache_position": 325, + "states_0": 326, + "states_1": 327, + "states_2": 328, + "states_3": 329, + "states_4": 330, + "states_5": 331, + "states_6": 332, + "states_7": 333, + "states_8": 334, + "states_9": 335, + "states_10": 336, + "states_11": 337, + "states_12": 338, + "states_13": 339, + "states_14": 340, + "states_15": 341, + "states_16": 342, + "states_17": 343, + "states_18": 344, + "states_19": 345, + "states_20": 346, + "states_21": 347, + "states_22": 348, + "states_23": 349, + "states_24": 350, + "states_25": 351, + "states_26": 352, + "states_27": 353, + "states_28": 354, + "states_29": 355, + "states_30": 356, + "states_31": 357, + "states_32": 358, + "states_33": 359, + "states_34": 360, + "states_35": 361, + "states_36": 362, + "states_37": 363, + "states_38": 364, + "states_39": 365, + "states_40": 366, + "states_41": 367, + "states_42": 368, + "states_43": 369, + "states_44": 370, + "states_45": 371, + "states_46": 372, + "states_47": 373, + "p_model_model_language_model_embed_tokens_weight__rows_0_32768": 374, + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768": 375, + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768": 376, + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768": 377, + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768": 378, + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768": 379, + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768": 380, + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944": 381, + "embedding__part_0": 382, + "embedding__part_1": 383, + "embedding__part_2": 384, + "embedding__part_3": 385, + "embedding__part_4": 386, + "embedding__part_5": 387, + "embedding__part_6": 388, + "embedding__part_7": 389, + "embedding__sum_0": 390, + "embedding__sum_1": 382, + "embedding__sum_2": 383, + "embedding__sum_3": 390, + "embedding__sum_4": 384, + "embedding__sum_5": 382, + "embedding": 385, + "where": 383, + "slice_1": 386, + "unsqueeze": 390, + "unsqueeze_1": 387, + "unsqueeze_2": 384, + "expand": 388, + "unsqueeze_3": 382, + "_to_copy": 389, + "matmul": 385, + "transpose": 390, + "select": 387, + "select_1": 384, + "slice_2": 386, + "slice_3": 382, + "copy": 388, + "transpose_1": 389, + "select_2": 390, + "slice_scatter": 384, + "select_scatter": 387, + "transpose_2": 386, + "transpose_7": 385, + "select_7": 388, + "slice_7": 390, + "transpose_8": 384, + "select_8": 389, + "slice_8": 387, + "copy_1": 385, + "transpose_9": 388, + "select_9": 384, + "slice_scatter_1": 389, + "select_scatter_1": 387, + "transpose_10": 386, + "transpose_12": 385, + "select_11": 384, + "cat": 389, + "cos": 388, + "mul": 387, + "sin": 386, + "mul_1": 385, + "mul_3": 384, + "type_as": 388, + "linear": 391, + "transpose_13": 392, + "linear_1": 389, + "view": 386, + "linear_2": 384, + "linear_3": 389, + "cat_1": 393, + "slice_10": 326, + "squeeze": 388, + "unsqueeze_4": 391, + "conv1d": 394, + "slice_11": 393, + "silu": 394, + "slice_12": 392, + "transpose_14": 391, + "slice_13": 388, + "slice_14": 392, + "slice_15": 393, + "view_1": 391, + "view_2": 388, + "view_3": 392, + "sigmoid": 393, + "exp": 384, + "neg": 394, + "add_2": 384, + "softplus": 389, + "mul_4": 384, + "mul_5": 389, + "sum_1": 394, + "add_3": 389, + "rsqrt_1": 394, + "mul_6": 389, + "mul_7": 391, + "sum_2": 394, + "add_4": 391, + "rsqrt_2": 394, + "mul_8": 391, + "normalized_gated_delta_rule": 395, + "slice_16": 327, + "slice_17": 388, + "transpose_15": 389, + "clone": 384, + "view_4": 388, + "view_5": 389, + "mul_10": 384, + "mul_11": 386, + "view_6": 388, + "linear_4": 389, + "add_6": 384, + "mul_13": 386, + "type_as_1": 388, + "linear_5": 391, + "linear_6": 392, + "mul_14": 393, + "linear_7": 383, + "add_9": 389, + "mul_16": 386, + "type_as_2": 388, + "linear_8": 391, + "transpose_16": 392, + "linear_9": 384, + "view_7": 383, + "linear_10": 386, + "linear_11": 384, + "cat_2": 393, + "slice_18": 328, + "squeeze_1": 388, + "unsqueeze_5": 391, + "conv1d_1": 394, + "slice_19": 393, + "silu_3": 394, + "slice_20": 392, + "transpose_17": 391, + "slice_21": 388, + "slice_22": 392, + "slice_23": 393, + "view_8": 391, + "view_9": 388, + "view_10": 392, + "sigmoid_1": 393, + "exp_1": 386, + "neg_1": 394, + "add_12": 386, + "softplus_1": 384, + "mul_17": 386, + "mul_18": 384, + "sum_3": 394, + "add_13": 384, + "rsqrt_6": 394, + "mul_19": 384, + "mul_20": 391, + "sum_4": 394, + "add_14": 391, + "rsqrt_7": 394, + "mul_21": 391, + "normalized_gated_delta_rule_1": 395, + "slice_24": 329, + "slice_25": 388, + "transpose_18": 384, + "clone_1": 386, + "view_11": 388, + "view_12": 384, + "mul_23": 386, + "mul_24": 383, + "view_13": 388, + "linear_12": 384, + "add_16": 386, + "mul_26": 383, + "type_as_3": 388, + "linear_13": 391, + "linear_14": 392, + "mul_27": 393, + "linear_15": 389, + "add_19": 384, + "mul_29": 383, + "type_as_4": 388, + "linear_16": 391, + "transpose_19": 392, + "linear_17": 386, + "view_14": 389, + "linear_18": 383, + "linear_19": 386, + "cat_3": 393, + "slice_26": 330, + "squeeze_2": 388, + "unsqueeze_6": 391, + "conv1d_2": 394, + "slice_27": 393, + "silu_6": 394, + "slice_28": 392, + "transpose_20": 391, + "slice_29": 388, + "slice_30": 392, + "slice_31": 393, + "view_15": 391, + "view_16": 388, + "view_17": 392, + "sigmoid_2": 393, + "exp_2": 383, + "neg_2": 394, + "add_22": 383, + "softplus_2": 386, + "mul_30": 383, + "mul_31": 386, + "sum_5": 394, + "add_23": 386, + "rsqrt_11": 394, + "mul_32": 386, + "mul_33": 391, + "sum_6": 394, + "add_24": 391, + "rsqrt_12": 394, + "mul_34": 391, + "normalized_gated_delta_rule_2": 395, + "slice_32": 331, + "slice_33": 388, + "transpose_21": 386, + "clone_2": 383, + "view_18": 388, + "view_19": 386, + "mul_36": 383, + "mul_37": 389, + "view_20": 388, + "linear_20": 386, + "add_26": 383, + "mul_39": 389, + "type_as_5": 388, + "linear_21": 391, + "linear_22": 392, + "mul_40": 393, + "linear_23": 384, + "add_29": 386, + "mul_42": 389, + "type_as_6": 388, + "linear_24": 391, + "view_21": 392, + "slice_34": 383, + "slice_35": 384, + "clone_3": 389, + "_unsafe_view": 384, + "view_22": 389, + "mul_44": 383, + "type_as_7": 389, + "transpose_22": 383, + "linear_25": 389, + "view_23": 391, + "mul_46": 389, + "type_as_8": 392, + "transpose_23": 389, + "linear_26": 391, + "view_24": 388, + "transpose_24": 392, + "unsqueeze_7": 388, + "unsqueeze_8": 391, + "slice_36": 393, + "slice_37": 394, + "slice_38": 383, + "slice_39": 395, + "mul_47": 389, + "slice_40": 396, + "slice_41": 397, + "neg_3": 393, + "cat_4": 398, + "mul_48": 393, + "add_36": 398, + "mul_49": 397, + "slice_42": 396, + "slice_43": 389, + "neg_4": 388, + "cat_5": 383, + "mul_50": 396, + "add_37": 389, + "cat_6": 388, + "cat_7": 398, + "cache_update": 332, + "cache_update_1": 333, + "unsqueeze_9": 399, + "expand_1": 400, + "clone_4": 401, + "_unsafe_view_1": 400, + "unsqueeze_10": 399, + "expand_2": 401, + "clone_5": 402, + "_unsafe_view_2": 401, + "transpose_25": 402, + "matmul_1": 399, + "mul_51": 400, + "add_38": 399, + "softmax": 402, + "matmul_2": 383, + "transpose_26": 389, + "clone_6": 388, + "view_25": 383, + "sigmoid_3": 389, + "mul_52": 388, + "linear_27": 384, + "add_39": 383, + "mul_54": 389, + "type_as_9": 388, + "linear_28": 391, + "linear_29": 392, + "mul_55": 393, + "linear_30": 386, + "add_42": 384, + "mul_57": 389, + "type_as_10": 388, + "linear_31": 391, + "transpose_27": 392, + "linear_32": 383, + "view_26": 386, + "linear_33": 397, + "linear_34": 396, + "cat_8": 393, + "slice_44": 334, + "squeeze_3": 389, + "unsqueeze_11": 383, + "conv1d_3": 394, + "slice_45": 393, + "silu_10": 394, + "slice_46": 391, + "transpose_28": 392, + "slice_47": 388, + "slice_48": 389, + "slice_49": 383, + "view_27": 391, + "view_28": 388, + "view_29": 389, + "sigmoid_4": 398, + "exp_3": 397, + "neg_5": 383, + "add_45": 397, + "softplus_3": 396, + "mul_58": 397, + "mul_59": 383, + "sum_7": 396, + "add_46": 383, + "rsqrt_20": 396, + "mul_60": 383, + "mul_61": 392, + "sum_8": 396, + "add_47": 391, + "rsqrt_21": 396, + "mul_62": 392, + "normalized_gated_delta_rule_3": 395, + "slice_50": 335, + "slice_51": 388, + "transpose_29": 383, + "clone_7": 389, + "view_30": 388, + "view_31": 383, + "mul_64": 389, + "mul_65": 386, + "view_32": 388, + "linear_35": 383, + "add_49": 389, + "mul_67": 386, + "type_as_11": 388, + "linear_36": 391, + "linear_37": 392, + "mul_68": 393, + "linear_38": 384, + "add_52": 383, + "mul_70": 386, + "type_as_12": 388, + "linear_39": 391, + "transpose_30": 392, + "linear_40": 389, + "view_33": 384, + "linear_41": 396, + "linear_42": 397, + "cat_9": 393, + "slice_52": 336, + "squeeze_4": 386, + "unsqueeze_12": 389, + "conv1d_4": 394, + "slice_53": 393, + "silu_13": 394, + "slice_54": 391, + "transpose_31": 392, + "slice_55": 388, + "slice_56": 386, + "slice_57": 389, + "view_34": 391, + "view_35": 388, + "view_36": 386, + "sigmoid_5": 398, + "exp_4": 396, + "neg_6": 389, + "add_55": 396, + "softplus_4": 397, + "mul_71": 396, + "mul_72": 389, + "sum_9": 397, + "add_56": 389, + "rsqrt_25": 397, + "mul_73": 389, + "mul_74": 392, + "sum_10": 397, + "add_57": 391, + "rsqrt_26": 397, + "mul_75": 392, + "normalized_gated_delta_rule_4": 395, + "slice_58": 337, + "slice_59": 388, + "transpose_32": 389, + "clone_8": 386, + "view_37": 388, + "view_38": 389, + "mul_77": 386, + "mul_78": 384, + "view_39": 388, + "linear_43": 389, + "add_59": 386, + "mul_80": 384, + "type_as_13": 388, + "linear_44": 391, + "linear_45": 392, + "mul_81": 393, + "linear_46": 383, + "add_62": 389, + "mul_83": 384, + "type_as_14": 388, + "linear_47": 391, + "transpose_33": 392, + "linear_48": 386, + "view_40": 383, + "linear_49": 397, + "linear_50": 396, + "cat_10": 393, + "slice_60": 338, + "squeeze_5": 384, + "unsqueeze_13": 386, + "conv1d_5": 394, + "slice_61": 393, + "silu_16": 394, + "slice_62": 391, + "transpose_34": 392, + "slice_63": 388, + "slice_64": 384, + "slice_65": 386, + "view_41": 391, + "view_42": 388, + "view_43": 384, + "sigmoid_6": 398, + "exp_5": 397, + "neg_7": 386, + "add_65": 397, + "softplus_5": 396, + "mul_84": 397, + "mul_85": 386, + "sum_11": 396, + "add_66": 386, + "rsqrt_30": 396, + "mul_86": 386, + "mul_87": 392, + "sum_12": 396, + "add_67": 391, + "rsqrt_31": 396, + "mul_88": 392, + "normalized_gated_delta_rule_5": 395, + "slice_66": 339, + "slice_67": 388, + "transpose_35": 386, + "clone_9": 384, + "view_44": 388, + "view_45": 386, + "mul_90": 384, + "mul_91": 383, + "view_46": 388, + "linear_51": 386, + "add_69": 384, + "mul_93": 383, + "type_as_15": 388, + "linear_52": 391, + "linear_53": 392, + "mul_94": 393, + "linear_54": 389, + "add_72": 386, + "mul_96": 383, + "type_as_16": 388, + "linear_55": 391, + "view_47": 392, + "slice_68": 384, + "slice_69": 389, + "clone_10": 383, + "_unsafe_view_3": 389, + "view_48": 383, + "mul_98": 384, + "type_as_17": 383, + "transpose_36": 384, + "linear_56": 398, + "view_49": 383, + "mul_100": 398, + "type_as_18": 383, + "transpose_37": 398, + "linear_57": 383, + "view_50": 388, + "transpose_38": 383, + "unsqueeze_14": 396, + "unsqueeze_15": 397, + "slice_70": 388, + "slice_71": 391, + "slice_72": 384, + "slice_73": 392, + "mul_101": 398, + "slice_74": 393, + "slice_75": 394, + "neg_8": 388, + "cat_11": 394, + "mul_102": 388, + "add_79": 393, + "mul_103": 398, + "slice_76": 396, + "slice_77": 388, + "neg_9": 384, + "cat_12": 388, + "mul_104": 396, + "add_80": 397, + "cat_13": 384, + "cat_14": 398, + "cache_update_2": 340, + "cache_update_3": 341, + "unsqueeze_16": 399, + "expand_3": 400, + "clone_11": 402, + "_unsafe_view_4": 401, + "unsqueeze_17": 399, + "expand_4": 400, + "clone_12": 402, + "_unsafe_view_5": 400, + "transpose_39": 402, + "matmul_3": 399, + "mul_105": 401, + "add_81": 399, + "softmax_1": 402, + "matmul_4": 388, + "transpose_40": 383, + "clone_13": 384, + "view_51": 388, + "sigmoid_7": 383, + "mul_106": 384, + "linear_58": 389, + "add_82": 388, + "mul_108": 383, + "type_as_19": 384, + "linear_59": 391, + "linear_60": 392, + "mul_109": 393, + "linear_61": 386, + "add_85": 389, + "mul_111": 383, + "type_as_20": 384, + "linear_62": 391, + "transpose_41": 392, + "linear_63": 388, + "view_52": 386, + "linear_64": 396, + "linear_65": 397, + "cat_15": 393, + "slice_78": 342, + "squeeze_6": 383, + "unsqueeze_18": 388, + "conv1d_6": 394, + "slice_79": 393, + "silu_20": 394, + "slice_80": 391, + "transpose_42": 392, + "slice_81": 384, + "slice_82": 383, + "slice_83": 388, + "view_53": 391, + "view_54": 384, + "view_55": 383, + "sigmoid_8": 398, + "exp_6": 396, + "neg_10": 388, + "add_88": 396, + "softplus_6": 397, + "mul_112": 396, + "mul_113": 388, + "sum_13": 397, + "add_89": 388, + "rsqrt_39": 397, + "mul_114": 388, + "mul_115": 392, + "sum_14": 397, + "add_90": 391, + "rsqrt_40": 397, + "mul_116": 392, + "normalized_gated_delta_rule_6": 395, + "slice_84": 343, + "slice_85": 384, + "transpose_43": 388, + "clone_14": 383, + "view_56": 384, + "view_57": 388, + "mul_118": 383, + "mul_119": 386, + "view_58": 384, + "linear_66": 388, + "add_92": 383, + "mul_121": 386, + "type_as_21": 384, + "linear_67": 391, + "linear_68": 392, + "mul_122": 393, + "linear_69": 389, + "add_95": 388, + "mul_124": 386, + "type_as_22": 384, + "linear_70": 391, + "transpose_44": 392, + "linear_71": 383, + "view_59": 389, + "linear_72": 397, + "linear_73": 396, + "cat_16": 393, + "slice_86": 344, + "squeeze_7": 386, + "unsqueeze_19": 383, + "conv1d_7": 394, + "slice_87": 393, + "silu_23": 394, + "slice_88": 391, + "transpose_45": 392, + "slice_89": 384, + "slice_90": 386, + "slice_91": 383, + "view_60": 391, + "view_61": 384, + "view_62": 386, + "sigmoid_9": 398, + "exp_7": 397, + "neg_11": 383, + "add_98": 397, + "softplus_7": 396, + "mul_125": 397, + "mul_126": 383, + "sum_15": 396, + "add_99": 383, + "rsqrt_44": 396, + "mul_127": 383, + "mul_128": 392, + "sum_16": 396, + "add_100": 391, + "rsqrt_45": 396, + "mul_129": 392, + "normalized_gated_delta_rule_7": 395, + "slice_92": 345, + "slice_93": 384, + "transpose_46": 383, + "clone_15": 386, + "view_63": 384, + "view_64": 383, + "mul_131": 386, + "mul_132": 389, + "view_65": 384, + "linear_74": 383, + "add_102": 386, + "mul_134": 389, + "type_as_23": 384, + "linear_75": 391, + "linear_76": 392, + "mul_135": 393, + "linear_77": 388, + "add_105": 383, + "mul_137": 389, + "type_as_24": 384, + "linear_78": 391, + "transpose_47": 392, + "linear_79": 386, + "view_66": 388, + "linear_80": 396, + "linear_81": 397, + "cat_17": 393, + "slice_94": 346, + "squeeze_8": 389, + "unsqueeze_20": 386, + "conv1d_8": 394, + "slice_95": 393, + "silu_26": 394, + "slice_96": 391, + "transpose_48": 392, + "slice_97": 384, + "slice_98": 389, + "slice_99": 386, + "view_67": 391, + "view_68": 384, + "view_69": 389, + "sigmoid_10": 398, + "exp_8": 396, + "neg_12": 386, + "add_108": 396, + "softplus_8": 397, + "mul_138": 396, + "mul_139": 386, + "sum_17": 397, + "add_109": 386, + "rsqrt_49": 397, + "mul_140": 386, + "mul_141": 392, + "sum_18": 397, + "add_110": 391, + "rsqrt_50": 397, + "mul_142": 392, + "normalized_gated_delta_rule_8": 395, + "slice_100": 347, + "slice_101": 384, + "transpose_49": 386, + "clone_16": 389, + "view_70": 384, + "view_71": 386, + "mul_144": 389, + "mul_145": 388, + "view_72": 384, + "linear_82": 386, + "add_112": 389, + "mul_147": 388, + "type_as_25": 384, + "linear_83": 391, + "linear_84": 392, + "mul_148": 393, + "linear_85": 383, + "add_115": 386, + "mul_150": 388, + "type_as_26": 384, + "linear_86": 391, + "view_73": 392, + "slice_102": 389, + "slice_103": 383, + "clone_17": 388, + "_unsafe_view_6": 383, + "view_74": 388, + "mul_152": 389, + "type_as_27": 388, + "transpose_50": 389, + "linear_87": 398, + "view_75": 388, + "mul_154": 398, + "type_as_28": 388, + "transpose_51": 398, + "linear_88": 388, + "view_76": 384, + "transpose_52": 388, + "unsqueeze_21": 397, + "unsqueeze_22": 396, + "slice_104": 384, + "slice_105": 391, + "slice_106": 389, + "slice_107": 392, + "mul_155": 398, + "slice_108": 393, + "slice_109": 394, + "neg_13": 384, + "cat_18": 394, + "mul_156": 384, + "add_122": 393, + "mul_157": 398, + "slice_110": 397, + "slice_111": 384, + "neg_14": 389, + "cat_19": 384, + "mul_158": 397, + "add_123": 396, + "cat_20": 389, + "cat_21": 398, + "cache_update_4": 348, + "cache_update_5": 349, + "unsqueeze_23": 399, + "expand_5": 401, + "clone_18": 402, + "_unsafe_view_7": 400, + "unsqueeze_24": 399, + "expand_6": 401, + "clone_19": 402, + "_unsafe_view_8": 401, + "transpose_53": 402, + "matmul_5": 399, + "mul_159": 400, + "add_124": 399, + "softmax_2": 402, + "matmul_6": 384, + "transpose_54": 388, + "clone_20": 389, + "view_77": 384, + "sigmoid_11": 388, + "mul_160": 389, + "linear_89": 383, + "add_125": 384, + "mul_162": 388, + "type_as_29": 389, + "linear_90": 391, + "linear_91": 392, + "mul_163": 393, + "linear_92": 386, + "add_128": 383, + "mul_165": 388, + "type_as_30": 389, + "linear_93": 391, + "transpose_55": 392, + "linear_94": 384, + "view_78": 386, + "linear_95": 397, + "linear_96": 396, + "cat_22": 393, + "slice_112": 350, + "squeeze_9": 388, + "unsqueeze_25": 384, + "conv1d_9": 394, + "slice_113": 393, + "silu_30": 394, + "slice_114": 391, + "transpose_56": 392, + "slice_115": 389, + "slice_116": 388, + "slice_117": 384, + "view_79": 391, + "view_80": 389, + "view_81": 388, + "sigmoid_12": 398, + "exp_9": 397, + "neg_15": 384, + "add_131": 397, + "softplus_9": 396, + "mul_166": 397, + "mul_167": 384, + "sum_19": 396, + "add_132": 384, + "rsqrt_58": 396, + "mul_168": 384, + "mul_169": 392, + "sum_20": 396, + "add_133": 391, + "rsqrt_59": 396, + "mul_170": 392, + "normalized_gated_delta_rule_9": 395, + "slice_118": 351, + "slice_119": 389, + "transpose_57": 384, + "clone_21": 388, + "view_82": 389, + "view_83": 384, + "mul_172": 388, + "mul_173": 386, + "view_84": 389, + "linear_97": 384, + "add_135": 388, + "mul_175": 386, + "type_as_31": 389, + "linear_98": 391, + "linear_99": 392, + "mul_176": 393, + "linear_100": 383, + "add_138": 384, + "mul_178": 386, + "type_as_32": 389, + "linear_101": 391, + "transpose_58": 392, + "linear_102": 388, + "view_85": 383, + "linear_103": 396, + "linear_104": 397, + "cat_23": 393, + "slice_120": 352, + "squeeze_10": 386, + "unsqueeze_26": 388, + "conv1d_10": 394, + "slice_121": 393, + "silu_33": 394, + "slice_122": 391, + "transpose_59": 392, + "slice_123": 389, + "slice_124": 386, + "slice_125": 388, + "view_86": 391, + "view_87": 389, + "view_88": 386, + "sigmoid_13": 398, + "exp_10": 396, + "neg_16": 388, + "add_141": 396, + "softplus_10": 397, + "mul_179": 396, + "mul_180": 388, + "sum_21": 397, + "add_142": 388, + "rsqrt_63": 397, + "mul_181": 388, + "mul_182": 392, + "sum_22": 397, + "add_143": 391, + "rsqrt_64": 397, + "mul_183": 392, + "normalized_gated_delta_rule_10": 395, + "slice_126": 353, + "slice_127": 389, + "transpose_60": 388, + "clone_22": 386, + "view_89": 389, + "view_90": 388, + "mul_185": 386, + "mul_186": 383, + "view_91": 389, + "linear_105": 388, + "add_145": 386, + "mul_188": 383, + "type_as_33": 389, + "linear_106": 391, + "linear_107": 392, + "mul_189": 393, + "linear_108": 384, + "add_148": 388, + "mul_191": 383, + "type_as_34": 389, + "linear_109": 391, + "transpose_61": 392, + "linear_110": 386, + "view_92": 384, + "linear_111": 397, + "linear_112": 396, + "cat_24": 393, + "slice_128": 354, + "squeeze_11": 383, + "unsqueeze_27": 386, + "conv1d_11": 394, + "slice_129": 393, + "silu_36": 394, + "slice_130": 391, + "transpose_62": 392, + "slice_131": 389, + "slice_132": 383, + "slice_133": 386, + "view_93": 391, + "view_94": 389, + "view_95": 383, + "sigmoid_14": 398, + "exp_11": 397, + "neg_17": 386, + "add_151": 397, + "softplus_11": 396, + "mul_192": 397, + "mul_193": 386, + "sum_23": 396, + "add_152": 386, + "rsqrt_68": 396, + "mul_194": 386, + "mul_195": 392, + "sum_24": 396, + "add_153": 391, + "rsqrt_69": 396, + "mul_196": 392, + "normalized_gated_delta_rule_11": 395, + "slice_134": 355, + "slice_135": 389, + "transpose_63": 386, + "clone_23": 383, + "view_96": 389, + "view_97": 386, + "mul_198": 383, + "mul_199": 384, + "view_98": 389, + "linear_113": 386, + "add_155": 383, + "mul_201": 384, + "type_as_35": 389, + "linear_114": 391, + "linear_115": 392, + "mul_202": 393, + "linear_116": 388, + "add_158": 386, + "mul_204": 384, + "type_as_36": 389, + "linear_117": 391, + "view_99": 392, + "slice_136": 383, + "slice_137": 388, + "clone_24": 384, + "_unsafe_view_9": 388, + "view_100": 384, + "mul_206": 383, + "type_as_37": 384, + "transpose_64": 383, + "linear_118": 398, + "view_101": 384, + "mul_208": 398, + "type_as_38": 384, + "transpose_65": 398, + "linear_119": 384, + "view_102": 389, + "transpose_66": 384, + "unsqueeze_28": 396, + "unsqueeze_29": 397, + "slice_138": 389, + "slice_139": 391, + "slice_140": 383, + "slice_141": 392, + "mul_209": 398, + "slice_142": 393, + "slice_143": 394, + "neg_18": 389, + "cat_25": 394, + "mul_210": 389, + "add_165": 393, + "mul_211": 398, + "slice_144": 396, + "slice_145": 389, + "neg_19": 383, + "cat_26": 389, + "mul_212": 396, + "add_166": 397, + "cat_27": 383, + "cat_28": 398, + "cache_update_6": 356, + "cache_update_7": 357, + "unsqueeze_30": 399, + "expand_7": 400, + "clone_25": 402, + "_unsafe_view_10": 401, + "unsqueeze_31": 399, + "expand_8": 400, + "clone_26": 402, + "_unsafe_view_11": 400, + "transpose_67": 402, + "matmul_7": 399, + "mul_213": 401, + "add_167": 399, + "softmax_3": 402, + "matmul_8": 389, + "transpose_68": 384, + "clone_27": 383, + "view_103": 389, + "sigmoid_15": 384, + "mul_214": 383, + "linear_120": 388, + "add_168": 389, + "mul_216": 384, + "type_as_39": 383, + "linear_121": 391, + "linear_122": 392, + "mul_217": 393, + "linear_123": 386, + "add_171": 388, + "mul_219": 384, + "type_as_40": 383, + "linear_124": 391, + "transpose_69": 392, + "linear_125": 389, + "view_104": 386, + "linear_126": 396, + "linear_127": 397, + "cat_29": 393, + "slice_146": 358, + "squeeze_12": 384, + "unsqueeze_32": 389, + "conv1d_12": 394, + "slice_147": 393, + "silu_40": 394, + "slice_148": 391, + "transpose_70": 392, + "slice_149": 383, + "slice_150": 384, + "slice_151": 389, + "view_105": 391, + "view_106": 383, + "view_107": 384, + "sigmoid_16": 398, + "exp_12": 396, + "neg_20": 389, + "add_174": 396, + "softplus_12": 397, + "mul_220": 396, + "mul_221": 389, + "sum_25": 397, + "add_175": 389, + "rsqrt_77": 397, + "mul_222": 389, + "mul_223": 392, + "sum_26": 397, + "add_176": 391, + "rsqrt_78": 397, + "mul_224": 392, + "normalized_gated_delta_rule_12": 395, + "slice_152": 359, + "slice_153": 383, + "transpose_71": 389, + "clone_28": 384, + "view_108": 383, + "view_109": 389, + "mul_226": 384, + "mul_227": 386, + "view_110": 383, + "linear_128": 389, + "add_178": 384, + "mul_229": 386, + "type_as_41": 383, + "linear_129": 391, + "linear_130": 392, + "mul_230": 393, + "linear_131": 388, + "add_181": 389, + "mul_232": 386, + "type_as_42": 383, + "linear_132": 391, + "transpose_72": 392, + "linear_133": 384, + "view_111": 388, + "linear_134": 397, + "linear_135": 396, + "cat_30": 393, + "slice_154": 360, + "squeeze_13": 386, + "unsqueeze_33": 384, + "conv1d_13": 394, + "slice_155": 393, + "silu_43": 394, + "slice_156": 391, + "transpose_73": 392, + "slice_157": 383, + "slice_158": 386, + "slice_159": 384, + "view_112": 391, + "view_113": 383, + "view_114": 386, + "sigmoid_17": 398, + "exp_13": 397, + "neg_21": 384, + "add_184": 397, + "softplus_13": 396, + "mul_233": 397, + "mul_234": 384, + "sum_27": 396, + "add_185": 384, + "rsqrt_82": 396, + "mul_235": 384, + "mul_236": 392, + "sum_28": 396, + "add_186": 391, + "rsqrt_83": 396, + "mul_237": 392, + "normalized_gated_delta_rule_13": 395, + "slice_160": 361, + "slice_161": 383, + "transpose_74": 384, + "clone_29": 386, + "view_115": 383, + "view_116": 384, + "mul_239": 386, + "mul_240": 388, + "view_117": 383, + "linear_136": 384, + "add_188": 386, + "mul_242": 388, + "type_as_43": 383, + "linear_137": 391, + "linear_138": 392, + "mul_243": 393, + "linear_139": 389, + "add_191": 384, + "mul_245": 388, + "type_as_44": 383, + "linear_140": 391, + "transpose_75": 392, + "linear_141": 386, + "view_118": 389, + "linear_142": 396, + "linear_143": 397, + "cat_31": 393, + "slice_162": 362, + "squeeze_14": 388, + "unsqueeze_34": 386, + "conv1d_14": 394, + "slice_163": 393, + "silu_46": 394, + "slice_164": 391, + "transpose_76": 392, + "slice_165": 383, + "slice_166": 388, + "slice_167": 386, + "view_119": 391, + "view_120": 383, + "view_121": 388, + "sigmoid_18": 398, + "exp_14": 396, + "neg_22": 386, + "add_194": 396, + "softplus_14": 397, + "mul_246": 396, + "mul_247": 386, + "sum_29": 397, + "add_195": 386, + "rsqrt_87": 397, + "mul_248": 386, + "mul_249": 392, + "sum_30": 397, + "add_196": 391, + "rsqrt_88": 397, + "mul_250": 392, + "normalized_gated_delta_rule_14": 395, + "slice_168": 363, + "slice_169": 383, + "transpose_77": 386, + "clone_30": 388, + "view_122": 383, + "view_123": 386, + "mul_252": 388, + "mul_253": 389, + "view_124": 383, + "linear_144": 386, + "add_198": 388, + "mul_255": 389, + "type_as_45": 383, + "linear_145": 391, + "linear_146": 392, + "mul_256": 393, + "linear_147": 384, + "add_201": 386, + "mul_258": 389, + "type_as_46": 383, + "linear_148": 391, + "view_125": 392, + "slice_170": 388, + "slice_171": 384, + "clone_31": 389, + "_unsafe_view_12": 384, + "view_126": 389, + "mul_260": 388, + "type_as_47": 389, + "transpose_78": 388, + "linear_149": 398, + "view_127": 389, + "mul_262": 398, + "type_as_48": 389, + "transpose_79": 398, + "linear_150": 389, + "view_128": 383, + "transpose_80": 389, + "unsqueeze_35": 397, + "unsqueeze_36": 396, + "slice_172": 383, + "slice_173": 391, + "slice_174": 388, + "slice_175": 392, + "mul_263": 398, + "slice_176": 393, + "slice_177": 394, + "neg_23": 383, + "cat_32": 394, + "mul_264": 383, + "add_208": 393, + "mul_265": 398, + "slice_178": 397, + "slice_179": 383, + "neg_24": 388, + "cat_33": 383, + "mul_266": 397, + "add_209": 396, + "cat_34": 388, + "cat_35": 398, + "cache_update_8": 364, + "cache_update_9": 365, + "unsqueeze_37": 399, + "expand_9": 401, + "clone_32": 402, + "_unsafe_view_13": 400, + "unsqueeze_38": 399, + "expand_10": 401, + "clone_33": 402, + "_unsafe_view_14": 401, + "transpose_81": 402, + "matmul_9": 399, + "mul_267": 400, + "add_210": 399, + "softmax_4": 402, + "matmul_10": 383, + "transpose_82": 389, + "clone_34": 388, + "view_129": 383, + "sigmoid_19": 389, + "mul_268": 388, + "linear_151": 384, + "add_211": 383, + "mul_270": 389, + "type_as_49": 388, + "linear_152": 391, + "linear_153": 392, + "mul_271": 393, + "linear_154": 386, + "add_214": 384, + "mul_273": 389, + "type_as_50": 388, + "linear_155": 391, + "transpose_83": 392, + "linear_156": 383, + "view_130": 386, + "linear_157": 397, + "linear_158": 396, + "cat_36": 393, + "slice_180": 366, + "squeeze_15": 389, + "unsqueeze_39": 383, + "conv1d_15": 394, + "slice_181": 393, + "silu_50": 394, + "slice_182": 391, + "transpose_84": 392, + "slice_183": 388, + "slice_184": 389, + "slice_185": 383, + "view_131": 391, + "view_132": 388, + "view_133": 389, + "sigmoid_20": 398, + "exp_15": 397, + "neg_25": 383, + "add_217": 397, + "softplus_15": 396, + "mul_274": 397, + "mul_275": 383, + "sum_31": 396, + "add_218": 383, + "rsqrt_96": 396, + "mul_276": 383, + "mul_277": 392, + "sum_32": 396, + "add_219": 391, + "rsqrt_97": 396, + "mul_278": 392, + "normalized_gated_delta_rule_15": 395, + "slice_186": 367, + "slice_187": 388, + "transpose_85": 383, + "clone_35": 389, + "view_134": 388, + "view_135": 383, + "mul_280": 389, + "mul_281": 386, + "view_136": 388, + "linear_159": 383, + "add_221": 389, + "mul_283": 386, + "type_as_51": 388, + "linear_160": 391, + "linear_161": 392, + "mul_284": 393, + "linear_162": 384, + "add_224": 383, + "mul_286": 386, + "type_as_52": 388, + "linear_163": 391, + "transpose_86": 392, + "linear_164": 389, + "view_137": 384, + "linear_165": 396, + "linear_166": 397, + "cat_37": 393, + "slice_188": 368, + "squeeze_16": 386, + "unsqueeze_40": 389, + "conv1d_16": 394, + "slice_189": 393, + "silu_53": 394, + "slice_190": 391, + "transpose_87": 392, + "slice_191": 388, + "slice_192": 386, + "slice_193": 389, + "view_138": 391, + "view_139": 388, + "view_140": 386, + "sigmoid_21": 398, + "exp_16": 396, + "neg_26": 389, + "add_227": 396, + "softplus_16": 397, + "mul_287": 396, + "mul_288": 389, + "sum_33": 397, + "add_228": 389, + "rsqrt_101": 397, + "mul_289": 389, + "mul_290": 392, + "sum_34": 397, + "add_229": 391, + "rsqrt_102": 397, + "mul_291": 392, + "normalized_gated_delta_rule_16": 395, + "slice_194": 369, + "slice_195": 388, + "transpose_88": 389, + "clone_36": 386, + "view_141": 388, + "view_142": 389, + "mul_293": 386, + "mul_294": 384, + "view_143": 388, + "linear_167": 389, + "add_231": 386, + "mul_296": 384, + "type_as_53": 388, + "linear_168": 391, + "linear_169": 392, + "mul_297": 393, + "linear_170": 383, + "add_234": 389, + "mul_299": 384, + "type_as_54": 388, + "linear_171": 391, + "transpose_89": 392, + "linear_172": 386, + "view_144": 383, + "linear_173": 397, + "linear_174": 396, + "cat_38": 393, + "slice_196": 370, + "squeeze_17": 384, + "unsqueeze_41": 386, + "conv1d_17": 394, + "slice_197": 393, + "silu_56": 394, + "slice_198": 391, + "transpose_90": 392, + "slice_199": 388, + "slice_200": 384, + "slice_201": 386, + "view_145": 391, + "view_146": 388, + "view_147": 384, + "sigmoid_22": 398, + "exp_17": 397, + "neg_27": 386, + "add_237": 397, + "softplus_17": 396, + "mul_300": 397, + "mul_301": 386, + "sum_35": 396, + "add_238": 386, + "rsqrt_106": 396, + "mul_302": 386, + "mul_303": 392, + "sum_36": 396, + "add_239": 391, + "rsqrt_107": 396, + "mul_304": 392, + "normalized_gated_delta_rule_17": 395, + "slice_202": 371, + "slice_203": 388, + "transpose_91": 386, + "clone_37": 384, + "view_148": 388, + "view_149": 386, + "mul_306": 384, + "mul_307": 383, + "view_150": 388, + "linear_175": 386, + "add_241": 384, + "mul_309": 383, + "type_as_55": 388, + "linear_176": 391, + "linear_177": 392, + "mul_310": 393, + "linear_178": 389, + "add_244": 386, + "mul_312": 383, + "type_as_56": 388, + "linear_179": 391, + "view_151": 392, + "slice_204": 384, + "slice_205": 389, + "clone_38": 383, + "_unsafe_view_15": 389, + "view_152": 383, + "mul_314": 384, + "type_as_57": 383, + "transpose_92": 384, + "linear_180": 398, + "view_153": 383, + "mul_316": 398, + "type_as_58": 383, + "transpose_93": 398, + "linear_181": 383, + "view_154": 388, + "transpose_94": 383, + "unsqueeze_42": 396, + "unsqueeze_43": 397, + "slice_206": 388, + "slice_207": 387, + "slice_208": 385, + "slice_209": 384, + "mul_317": 398, + "slice_210": 391, + "slice_211": 392, + "neg_28": 388, + "cat_39": 392, + "mul_318": 388, + "add_251": 391, + "mul_319": 398, + "slice_212": 396, + "slice_213": 388, + "neg_29": 385, + "cat_40": 388, + "mul_320": 396, + "add_252": 397, + "cat_41": 385, + "cat_42": 398, + "cache_update_10": 372, + "cache_update_11": 373, + "unsqueeze_44": 399, + "expand_11": 400, + "clone_39": 402, + "_unsafe_view_16": 401, + "unsqueeze_45": 399, + "expand_12": 400, + "clone_40": 402, + "_unsafe_view_17": 400, + "transpose_95": 402, + "matmul_11": 399, + "mul_321": 401, + "add_253": 399, + "softmax_5": 402, + "matmul_12": 388, + "transpose_96": 387, + "clone_41": 384, + "view_155": 383, + "sigmoid_23": 385, + "mul_322": 388, + "linear_182": 387, + "add_254": 384, + "mul_324": 389, + "type_as_59": 383, + "linear_183": 392, + "linear_184": 391, + "mul_325": 393, + "linear_185": 385, + "add_257": 388, + "mul_327": 386, + "type_as_60": 387, + "alias": 389, + "linear_186__part_0": 399, + "linear_186__part_1": 401, + "linear_186__part_2": 402, + "linear_186__part_3": 400, + "linear_186__part_4": 403, + "linear_186__part_5": 404, + "linear_186__part_6": 405, + "linear_186__part_7": 406, + "linear_186__cat_0_0": 407, + "linear_186__cat_0_7": 403, + "linear_186": 401 + }, + "byteLength": 4021952320 + }, + "rewrites": [ + { + "pattern": "rms_norm", + "nodes": [ + "pow_1", + "mean", + "add", + "rsqrt", + "mul_2", + "add_1", + "mul_3" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_2", + "mean_1", + "add_5", + "rsqrt_3", + "mul_9", + "mul_10" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_3", + "mean_2", + "add_7", + "rsqrt_4", + "mul_12", + "add_8", + "mul_13" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_4", + "mean_3", + "add_10", + "rsqrt_5", + "mul_15", + "add_11", + "mul_16" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_5", + "mean_4", + "add_15", + "rsqrt_8", + "mul_22", + "mul_23" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_6", + "mean_5", + "add_17", + "rsqrt_9", + "mul_25", + "add_18", + "mul_26" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_7", + "mean_6", + "add_20", + "rsqrt_10", + "mul_28", + "add_21", + "mul_29" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_8", + "mean_7", + "add_25", + "rsqrt_13", + "mul_35", + "mul_36" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_9", + "mean_8", + "add_27", + "rsqrt_14", + "mul_38", + "add_28", + "mul_39" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_10", + "mean_9", + "add_30", + "rsqrt_15", + "mul_41", + "add_31", + "mul_42" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_11", + "mean_10", + "add_32", + "rsqrt_16", + "mul_43", + "add_33", + "mul_44" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_12", + "mean_11", + "add_34", + "rsqrt_17", + "mul_45", + "add_35", + "mul_46" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_13", + "mean_12", + "add_40", + "rsqrt_18", + "mul_53", + "add_41", + "mul_54" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_14", + "mean_13", + "add_43", + "rsqrt_19", + "mul_56", + "add_44", + "mul_57" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_15", + "mean_14", + "add_48", + "rsqrt_22", + "mul_63", + "mul_64" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_16", + "mean_15", + "add_50", + "rsqrt_23", + "mul_66", + "add_51", + "mul_67" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_17", + "mean_16", + "add_53", + "rsqrt_24", + "mul_69", + "add_54", + "mul_70" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_18", + "mean_17", + "add_58", + "rsqrt_27", + "mul_76", + "mul_77" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_19", + "mean_18", + "add_60", + "rsqrt_28", + "mul_79", + "add_61", + "mul_80" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_20", + "mean_19", + "add_63", + "rsqrt_29", + "mul_82", + "add_64", + "mul_83" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_21", + "mean_20", + "add_68", + "rsqrt_32", + "mul_89", + "mul_90" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_22", + "mean_21", + "add_70", + "rsqrt_33", + "mul_92", + "add_71", + "mul_93" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_23", + "mean_22", + "add_73", + "rsqrt_34", + "mul_95", + "add_74", + "mul_96" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_24", + "mean_23", + "add_75", + "rsqrt_35", + "mul_97", + "add_76", + "mul_98" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_25", + "mean_24", + "add_77", + "rsqrt_36", + "mul_99", + "add_78", + "mul_100" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_26", + "mean_25", + "add_83", + "rsqrt_37", + "mul_107", + "add_84", + "mul_108" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_27", + "mean_26", + "add_86", + "rsqrt_38", + "mul_110", + "add_87", + "mul_111" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_28", + "mean_27", + "add_91", + "rsqrt_41", + "mul_117", + "mul_118" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_29", + "mean_28", + "add_93", + "rsqrt_42", + "mul_120", + "add_94", + "mul_121" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_30", + "mean_29", + "add_96", + "rsqrt_43", + "mul_123", + "add_97", + "mul_124" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_31", + "mean_30", + "add_101", + "rsqrt_46", + "mul_130", + "mul_131" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_32", + "mean_31", + "add_103", + "rsqrt_47", + "mul_133", + "add_104", + "mul_134" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_33", + "mean_32", + "add_106", + "rsqrt_48", + "mul_136", + "add_107", + "mul_137" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_34", + "mean_33", + "add_111", + "rsqrt_51", + "mul_143", + "mul_144" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_35", + "mean_34", + "add_113", + "rsqrt_52", + "mul_146", + "add_114", + "mul_147" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_36", + "mean_35", + "add_116", + "rsqrt_53", + "mul_149", + "add_117", + "mul_150" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_37", + "mean_36", + "add_118", + "rsqrt_54", + "mul_151", + "add_119", + "mul_152" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_38", + "mean_37", + "add_120", + "rsqrt_55", + "mul_153", + "add_121", + "mul_154" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_39", + "mean_38", + "add_126", + "rsqrt_56", + "mul_161", + "add_127", + "mul_162" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_40", + "mean_39", + "add_129", + "rsqrt_57", + "mul_164", + "add_130", + "mul_165" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_41", + "mean_40", + "add_134", + "rsqrt_60", + "mul_171", + "mul_172" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_42", + "mean_41", + "add_136", + "rsqrt_61", + "mul_174", + "add_137", + "mul_175" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_43", + "mean_42", + "add_139", + "rsqrt_62", + "mul_177", + "add_140", + "mul_178" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_44", + "mean_43", + "add_144", + "rsqrt_65", + "mul_184", + "mul_185" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_45", + "mean_44", + "add_146", + "rsqrt_66", + "mul_187", + "add_147", + "mul_188" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_46", + "mean_45", + "add_149", + "rsqrt_67", + "mul_190", + "add_150", + "mul_191" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_47", + "mean_46", + "add_154", + "rsqrt_70", + "mul_197", + "mul_198" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_48", + "mean_47", + "add_156", + "rsqrt_71", + "mul_200", + "add_157", + "mul_201" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_49", + "mean_48", + "add_159", + "rsqrt_72", + "mul_203", + "add_160", + "mul_204" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_50", + "mean_49", + "add_161", + "rsqrt_73", + "mul_205", + "add_162", + "mul_206" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_51", + "mean_50", + "add_163", + "rsqrt_74", + "mul_207", + "add_164", + "mul_208" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_52", + "mean_51", + "add_169", + "rsqrt_75", + "mul_215", + "add_170", + "mul_216" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_53", + "mean_52", + "add_172", + "rsqrt_76", + "mul_218", + "add_173", + "mul_219" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_54", + "mean_53", + "add_177", + "rsqrt_79", + "mul_225", + "mul_226" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_55", + "mean_54", + "add_179", + "rsqrt_80", + "mul_228", + "add_180", + "mul_229" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_56", + "mean_55", + "add_182", + "rsqrt_81", + "mul_231", + "add_183", + "mul_232" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_57", + "mean_56", + "add_187", + "rsqrt_84", + "mul_238", + "mul_239" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_58", + "mean_57", + "add_189", + "rsqrt_85", + "mul_241", + "add_190", + "mul_242" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_59", + "mean_58", + "add_192", + "rsqrt_86", + "mul_244", + "add_193", + "mul_245" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_60", + "mean_59", + "add_197", + "rsqrt_89", + "mul_251", + "mul_252" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_61", + "mean_60", + "add_199", + "rsqrt_90", + "mul_254", + "add_200", + "mul_255" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_62", + "mean_61", + "add_202", + "rsqrt_91", + "mul_257", + "add_203", + "mul_258" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_63", + "mean_62", + "add_204", + "rsqrt_92", + "mul_259", + "add_205", + "mul_260" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_64", + "mean_63", + "add_206", + "rsqrt_93", + "mul_261", + "add_207", + "mul_262" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_65", + "mean_64", + "add_212", + "rsqrt_94", + "mul_269", + "add_213", + "mul_270" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_66", + "mean_65", + "add_215", + "rsqrt_95", + "mul_272", + "add_216", + "mul_273" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_67", + "mean_66", + "add_220", + "rsqrt_98", + "mul_279", + "mul_280" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_68", + "mean_67", + "add_222", + "rsqrt_99", + "mul_282", + "add_223", + "mul_283" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_69", + "mean_68", + "add_225", + "rsqrt_100", + "mul_285", + "add_226", + "mul_286" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_70", + "mean_69", + "add_230", + "rsqrt_103", + "mul_292", + "mul_293" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_71", + "mean_70", + "add_232", + "rsqrt_104", + "mul_295", + "add_233", + "mul_296" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_72", + "mean_71", + "add_235", + "rsqrt_105", + "mul_298", + "add_236", + "mul_299" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_73", + "mean_72", + "add_240", + "rsqrt_108", + "mul_305", + "mul_306" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_74", + "mean_73", + "add_242", + "rsqrt_109", + "mul_308", + "add_243", + "mul_309" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_75", + "mean_74", + "add_245", + "rsqrt_110", + "mul_311", + "add_246", + "mul_312" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_76", + "mean_75", + "add_247", + "rsqrt_111", + "mul_313", + "add_248", + "mul_314" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_77", + "mean_76", + "add_249", + "rsqrt_112", + "mul_315", + "add_250", + "mul_316" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_78", + "mean_77", + "add_255", + "rsqrt_113", + "mul_323", + "add_256", + "mul_324" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_79", + "mean_78", + "add_258", + "rsqrt_114", + "mul_326", + "add_259", + "mul_327" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_1", + "mul_11" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_2", + "mul_14" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_4", + "mul_24" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_5", + "mul_27" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_7", + "mul_37" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_8", + "mul_40" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_9", + "mul_55" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_11", + "mul_65" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_12", + "mul_68" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_14", + "mul_78" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_15", + "mul_81" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_17", + "mul_91" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_18", + "mul_94" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_19", + "mul_109" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_21", + "mul_119" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_22", + "mul_122" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_24", + "mul_132" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_25", + "mul_135" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_27", + "mul_145" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_28", + "mul_148" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_29", + "mul_163" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_31", + "mul_173" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_32", + "mul_176" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_34", + "mul_186" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_35", + "mul_189" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_37", + "mul_199" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_38", + "mul_202" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_39", + "mul_217" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_41", + "mul_227" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_42", + "mul_230" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_44", + "mul_240" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_45", + "mul_243" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_47", + "mul_253" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_48", + "mul_256" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_49", + "mul_271" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_51", + "mul_281" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_52", + "mul_284" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_54", + "mul_294" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_55", + "mul_297" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_57", + "mul_307" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_58", + "mul_310" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_59", + "mul_325" + ] + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_10" + ], + "input": "states_0", + "output": "slice_10", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_16" + ], + "input": "states_1", + "output": "slice_16", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_18" + ], + "input": "states_2", + "output": "slice_18", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_24" + ], + "input": "states_3", + "output": "slice_24", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_26" + ], + "input": "states_4", + "output": "slice_26", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_32" + ], + "input": "states_5", + "output": "slice_32", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_44" + ], + "input": "states_8", + "output": "slice_44", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_50" + ], + "input": "states_9", + "output": "slice_50", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_52" + ], + "input": "states_10", + "output": "slice_52", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_58" + ], + "input": "states_11", + "output": "slice_58", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_60" + ], + "input": "states_12", + "output": "slice_60", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_66" + ], + "input": "states_13", + "output": "slice_66", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_78" + ], + "input": "states_16", + "output": "slice_78", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_84" + ], + "input": "states_17", + "output": "slice_84", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_86" + ], + "input": "states_18", + "output": "slice_86", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_92" + ], + "input": "states_19", + "output": "slice_92", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_94" + ], + "input": "states_20", + "output": "slice_94", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_100" + ], + "input": "states_21", + "output": "slice_100", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_112" + ], + "input": "states_24", + "output": "slice_112", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_118" + ], + "input": "states_25", + "output": "slice_118", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_120" + ], + "input": "states_26", + "output": "slice_120", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_126" + ], + "input": "states_27", + "output": "slice_126", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_128" + ], + "input": "states_28", + "output": "slice_128", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_134" + ], + "input": "states_29", + "output": "slice_134", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_146" + ], + "input": "states_32", + "output": "slice_146", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_152" + ], + "input": "states_33", + "output": "slice_152", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_154" + ], + "input": "states_34", + "output": "slice_154", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_160" + ], + "input": "states_35", + "output": "slice_160", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_162" + ], + "input": "states_36", + "output": "slice_162", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_168" + ], + "input": "states_37", + "output": "slice_168", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_180" + ], + "input": "states_40", + "output": "slice_180", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_186" + ], + "input": "states_41", + "output": "slice_186", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_188" + ], + "input": "states_42", + "output": "slice_188", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_194" + ], + "input": "states_43", + "output": "slice_194", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_196" + ], + "input": "states_44", + "output": "slice_196", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_202" + ], + "input": "states_45", + "output": "slice_202", + "kind": "recurrent" + } + ], + "partitions": [ + { + "node": "embedding", + "weight": "p_model_model_language_model_embed_tokens_weight", + "rowsPerShard": 32768, + "bindingLimitBytes": 134217728 + }, + { + "node": "linear_186", + "weight": "p_model_model_language_model_embed_tokens_weight", + "rowsPerShard": 32768, + "bindingLimitBytes": 134217728 + } + ] +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-4.json b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-4.json new file mode 100644 index 0000000000000000000000000000000000000000..7d325f333910aacab8d86c80581e98a00d5d60d3 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-4.json @@ -0,0 +1,80234 @@ +{ + "inputs": [ + "input_ids", + "position_ids", + "attention_mask", + "image_embedding", + "is_image", + "cache_position", + "states_0", + "states_1", + "states_2", + "states_3", + "states_4", + "states_5", + "states_6", + "states_7", + "states_8", + "states_9", + "states_10", + "states_11", + "states_12", + "states_13", + "states_14", + "states_15", + "states_16", + "states_17", + "states_18", + "states_19", + "states_20", + "states_21", + "states_22", + "states_23", + "states_24", + "states_25", + "states_26", + "states_27", + "states_28", + "states_29", + "states_30", + "states_31", + "states_32", + "states_33", + "states_34", + "states_35", + "states_36", + "states_37", + "states_38", + "states_39", + "states_40", + "states_41", + "states_42", + "states_43", + "states_44", + "states_45", + "states_46", + "states_47" + ], + "outputs": [ + "linear_186", + "slice_10", + "slice_16", + "slice_18", + "slice_24", + "slice_26", + "slice_32", + "cache_update", + "cache_update_1", + "slice_44", + "slice_50", + "slice_52", + "slice_58", + "slice_60", + "slice_66", + "cache_update_2", + "cache_update_3", + "slice_78", + "slice_84", + "slice_86", + "slice_92", + "slice_94", + "slice_100", + "cache_update_4", + "cache_update_5", + "slice_112", + "slice_118", + "slice_120", + "slice_126", + "slice_128", + "slice_134", + "cache_update_6", + "cache_update_7", + "slice_146", + "slice_152", + "slice_154", + "slice_160", + "slice_162", + "slice_168", + "cache_update_8", + "cache_update_9", + "slice_180", + "slice_186", + "slice_188", + "slice_194", + "slice_196", + "slice_202", + "cache_update_10", + "cache_update_11" + ], + "tensors": { + "p_model_model_language_model_embed_tokens_weight": { + "shape": [ + 248320, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1017118720, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00000.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00001.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00002.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00003.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00004.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00005.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00006.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00007.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00008.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00009.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00010.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00011.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00012.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00013.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00014.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00015.bin", + "offset": 0, + "byteLength": 10485760 + } + ] + }, + "p_model_model_language_model_layers_0_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10485760, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10493952, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10494016, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10494080, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 35659904, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44048512, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44114048, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44179584, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44277888, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44278400, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_0_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 52667008, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 52675200, + "byteLength": 14433664 + }, + { + "path": "weights/00016.bin", + "offset": 0, + "byteLength": 10732160 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 10732160, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 35897984, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_1_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61063808, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072000, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072064, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072128, + "byteLength": 6036736 + }, + { + "path": "weights/00017.bin", + "offset": 0, + "byteLength": 19129088 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 19129088, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27517696, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27583232, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27648768, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27747072, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27747584, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_1_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 36136192, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 36144384, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 61310208, + "byteLength": 5798656 + }, + { + "path": "weights/00018.bin", + "offset": 0, + "byteLength": 19367168 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00018.bin", + "offset": 19367168, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_2_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44532992, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541184, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541248, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541312, + "byteLength": 22567552 + }, + { + "path": "weights/00019.bin", + "offset": 0, + "byteLength": 2598272 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 2598272, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 10986880, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11052416, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11117952, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11216256, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11216768, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_2_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 19605376, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 19613568, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 44779392, + "byteLength": 22329472 + }, + { + "path": "weights/00020.bin", + "offset": 0, + "byteLength": 2836352 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 2836352, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_3_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 28002176, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 28010368, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 44787584, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 44788608, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 46885760, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 46886784, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 48983936, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_3_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 57372544, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 57380736, + "byteLength": 9728128 + }, + { + "path": "weights/00021.bin", + "offset": 0, + "byteLength": 15437696 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 15437696, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 40603520, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_4_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65769344, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777536, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777600, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777664, + "byteLength": 1331200 + }, + { + "path": "weights/00022.bin", + "offset": 0, + "byteLength": 23834624 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 23834624, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32223232, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32288768, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32354304, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32452608, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32453120, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_4_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 40841728, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 40849920, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 66015744, + "byteLength": 1093120 + }, + { + "path": "weights/00023.bin", + "offset": 0, + "byteLength": 24072704 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00023.bin", + "offset": 24072704, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_5_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49238528, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246720, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246784, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246848, + "byteLength": 17862016 + }, + { + "path": "weights/00024.bin", + "offset": 0, + "byteLength": 7303808 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 7303808, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15692416, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15757952, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15823488, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15921792, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15922304, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_5_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 24310912, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 24319104, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 49484928, + "byteLength": 17623936 + }, + { + "path": "weights/00025.bin", + "offset": 0, + "byteLength": 7541888 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 7541888, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32707712, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32715904, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32715968, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32716032, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 57881856, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66270464, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66336000, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66401536, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66499840, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66500352, + "byteLength": 608512 + }, + { + "path": "weights/00026.bin", + "offset": 0, + "byteLength": 7780096 + } + ] + }, + "p_model_model_language_model_layers_6_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00026.bin", + "offset": 7780096, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 7788288, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 32954112, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 58119936, + "byteLength": 8988928 + }, + { + "path": "weights/00027.bin", + "offset": 0, + "byteLength": 16176896 + } + ] + }, + "p_model_model_language_model_layers_7_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 16176896, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 16185088, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 32962304, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 32963328, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 35060480, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 35061504, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 37158656, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_7_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 45547264, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 45555456, + "byteLength": 21553408 + }, + { + "path": "weights/00028.bin", + "offset": 0, + "byteLength": 3612416 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 3612416, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 28778240, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_8_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53944064, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952256, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952320, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952384, + "byteLength": 13156480 + }, + { + "path": "weights/00029.bin", + "offset": 0, + "byteLength": 12009344 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 12009344, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20397952, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20463488, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20529024, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20627328, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20627840, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_8_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 29016448, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 29024640, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 54190464, + "byteLength": 12918400 + }, + { + "path": "weights/00030.bin", + "offset": 0, + "byteLength": 12247424 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 12247424, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37413248, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421440, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421504, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421568, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 62587392, + "byteLength": 4521472 + }, + { + "path": "weights/00031.bin", + "offset": 0, + "byteLength": 3867136 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3867136, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3932672, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3998208, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 4096512, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 4097024, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_9_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 12485632, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 12493824, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 37659648, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 62825472, + "byteLength": 4283392 + }, + { + "path": "weights/00032.bin", + "offset": 0, + "byteLength": 20882432 + } + ] + }, + "p_model_model_language_model_layers_10_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20882432, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890624, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890688, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890752, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 46056576, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54445184, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54510720, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54576256, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54674560, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54675072, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_10_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 63063680, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 63071872, + "byteLength": 4036992 + }, + { + "path": "weights/00033.bin", + "offset": 0, + "byteLength": 21128832 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00033.bin", + "offset": 21128832, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00033.bin", + "offset": 46294656, + "byteLength": 20814208 + }, + { + "path": "weights/00034.bin", + "offset": 0, + "byteLength": 4351616 + } + ] + }, + "p_model_model_language_model_layers_11_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 4351616, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 4359808, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 21137024, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 21138048, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 23235200, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 23236224, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 25333376, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_11_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 33721984, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 33730176, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 58896000, + "byteLength": 8212864 + }, + { + "path": "weights/00035.bin", + "offset": 0, + "byteLength": 16952960 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00035.bin", + "offset": 16952960, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_12_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42118784, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42126976, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42127040, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42127104, + "byteLength": 24981760 + }, + { + "path": "weights/00036.bin", + "offset": 0, + "byteLength": 184064 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 184064, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8572672, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8638208, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8703744, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8802048, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8802560, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_12_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 17191168, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 17199360, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 42365184, + "byteLength": 24743680 + }, + { + "path": "weights/00037.bin", + "offset": 0, + "byteLength": 422144 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 422144, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25587968, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596160, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596224, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596288, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 50762112, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59150720, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59216256, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59281792, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59380096, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59380608, + "byteLength": 7728256 + }, + { + "path": "weights/00038.bin", + "offset": 0, + "byteLength": 660352 + } + ] + }, + "p_model_model_language_model_layers_13_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00038.bin", + "offset": 660352, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 668544, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 25834368, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 51000192, + "byteLength": 16108672 + }, + { + "path": "weights/00039.bin", + "offset": 0, + "byteLength": 9057152 + } + ] + }, + "p_model_model_language_model_layers_14_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9057152, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065344, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065408, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065472, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 34231296, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42619904, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42685440, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42750976, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42849280, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42849792, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_14_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 51238400, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 51246592, + "byteLength": 15862272 + }, + { + "path": "weights/00040.bin", + "offset": 0, + "byteLength": 9303552 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 9303552, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 34469376, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_15_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00040.bin", + "offset": 59635200, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 59643392, + "byteLength": 7465472 + }, + { + "path": "weights/00041.bin", + "offset": 0, + "byteLength": 9311744 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 9311744, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 9312768, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 11409920, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 11410944, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 13508096, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_15_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 21896704, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 21904896, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 47070720, + "byteLength": 20038144 + }, + { + "path": "weights/00042.bin", + "offset": 0, + "byteLength": 5127680 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 5127680, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30293504, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301696, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301760, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301824, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 55467648, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63856256, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63921792, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63987328, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 64085632, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 64086144, + "byteLength": 3022720 + }, + { + "path": "weights/00043.bin", + "offset": 0, + "byteLength": 5365888 + } + ] + }, + "p_model_model_language_model_layers_16_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00043.bin", + "offset": 5365888, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 5374080, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 30539904, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 55705728, + "byteLength": 11403136 + }, + { + "path": "weights/00044.bin", + "offset": 0, + "byteLength": 13762688 + } + ] + }, + "p_model_model_language_model_layers_17_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13762688, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13770880, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13770944, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13771008, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 38936832, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47325440, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47390976, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47456512, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47554816, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47555328, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_17_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 55943936, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 55952128, + "byteLength": 11156736 + }, + { + "path": "weights/00045.bin", + "offset": 0, + "byteLength": 14009088 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 14009088, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 39174912, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_18_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64340736, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64348928, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64348992, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64349056, + "byteLength": 2759808 + }, + { + "path": "weights/00046.bin", + "offset": 0, + "byteLength": 22406016 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 22406016, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30794624, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30860160, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30925696, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 31024000, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 31024512, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_18_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 39413120, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 39421312, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 64587136, + "byteLength": 2521728 + }, + { + "path": "weights/00047.bin", + "offset": 0, + "byteLength": 22644096 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 22644096, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 47809920, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 47818112, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 64595328, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 64596352, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 66693504, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 66694528, + "byteLength": 414336 + }, + { + "path": "weights/00048.bin", + "offset": 0, + "byteLength": 1682816 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 1682816, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_19_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00048.bin", + "offset": 10071424, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 10079616, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 35245440, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 60411264, + "byteLength": 6697600 + }, + { + "path": "weights/00049.bin", + "offset": 0, + "byteLength": 18468224 + } + ] + }, + "p_model_model_language_model_layers_20_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18468224, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476416, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476480, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476544, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 43642368, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52030976, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52096512, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52162048, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52260352, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52260864, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_20_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 60649472, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 60657664, + "byteLength": 6451200 + }, + { + "path": "weights/00050.bin", + "offset": 0, + "byteLength": 18714624 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00050.bin", + "offset": 18714624, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00050.bin", + "offset": 43880448, + "byteLength": 23228416 + }, + { + "path": "weights/00051.bin", + "offset": 0, + "byteLength": 1937408 + } + ] + }, + "p_model_model_language_model_layers_21_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1937408, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945600, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945664, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945728, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 27111552, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35500160, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35565696, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35631232, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35729536, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35730048, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_21_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 44118656, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 44126848, + "byteLength": 22982016 + }, + { + "path": "weights/00052.bin", + "offset": 0, + "byteLength": 2183808 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 2183808, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 27349632, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_22_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52515456, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523648, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523712, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523776, + "byteLength": 14585088 + }, + { + "path": "weights/00053.bin", + "offset": 0, + "byteLength": 10580736 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 10580736, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 18969344, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19034880, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19100416, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19198720, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19199232, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_22_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 27587840, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 27596032, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 52761856, + "byteLength": 14347008 + }, + { + "path": "weights/00054.bin", + "offset": 0, + "byteLength": 10818816 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 10818816, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_23_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 35984640, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 35992832, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 52770048, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 52771072, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 54868224, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 54869248, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 56966400, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_23_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 65355008, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 65363200, + "byteLength": 1745664 + }, + { + "path": "weights/00055.bin", + "offset": 0, + "byteLength": 23420160 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00055.bin", + "offset": 23420160, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00055.bin", + "offset": 48585984, + "byteLength": 18522880 + }, + { + "path": "weights/00056.bin", + "offset": 0, + "byteLength": 6642944 + } + ] + }, + "p_model_model_language_model_norm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00056.bin", + "offset": 6642944, + "byteLength": 8192 + } + ] + }, + "b_model_model_language_model_rotary_emb_inv_freq": { + "shape": [ + 32 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 128, + "parts": [ + { + "path": "weights/00056.bin", + "offset": 6651136, + "byteLength": 128 + } + ] + }, + "input_ids": { + "shape": [ + 1, + 4 + ], + "dtype": "int32", + "role": "input", + "byteLength": 16, + "indexBounds": [ + 0, + 248320 + ] + }, + "position_ids": { + "shape": [ + 4, + 1, + 4 + ], + "dtype": "int32", + "role": "input", + "byteLength": 64 + }, + "attention_mask": { + "shape": [ + 1, + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "input", + "byteLength": 65536 + }, + "image_embedding": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "input", + "byteLength": 32768 + }, + "is_image": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "bool", + "role": "input", + "byteLength": 16 + }, + "cache_position": { + "shape": [ + 1, + 4 + ], + "dtype": "int32", + "role": "input", + "byteLength": 16, + "indexBounds": [ + 0, + 4096 + ] + }, + "states_0": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_1": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_2": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_3": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_4": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_5": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_6": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_7": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_8": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_9": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_10": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_11": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_12": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_13": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_14": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_15": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_16": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_17": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_18": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_19": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_20": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_21": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_22": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_23": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_24": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_25": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_26": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_27": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_28": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_29": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_30": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_31": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_32": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_33": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_34": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_35": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_36": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_37": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_38": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_39": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_40": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_41": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_42": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_43": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_45": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_46": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_47": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "embedding": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "where": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_1": { + "shape": [ + 3, + 1, + 4 + ], + "dtype": "int32", + "role": "value", + "byteLength": 48 + }, + "unsqueeze": { + "shape": [ + 1, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "unsqueeze_1": { + "shape": [ + 1, + 1, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "unsqueeze_2": { + "shape": [ + 1, + 1, + 32, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "expand": { + "shape": [ + 3, + 1, + 32, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 384 + }, + "unsqueeze_3": { + "shape": [ + 3, + 1, + 1, + 4 + ], + "dtype": "int32", + "role": "value", + "byteLength": 48 + }, + "_to_copy": { + "shape": [ + 3, + 1, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 48 + }, + "matmul": { + "shape": [ + 3, + 1, + 32, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "transpose": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "select": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "select_1": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "slice_2": { + "shape": [ + 1, + 4, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 176 + }, + "slice_3": { + "shape": [ + 1, + 4, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 176 + }, + "copy": { + "shape": [ + 1, + 4, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 176 + }, + "transpose_1": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "select_2": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "slice_scatter": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "select_scatter": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "transpose_2": { + "shape": [ + 3, + 1, + 32, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "transpose_7": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "select_7": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "slice_7": { + "shape": [ + 1, + 4, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 160 + }, + "transpose_8": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "select_8": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "slice_8": { + "shape": [ + 1, + 4, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 160 + }, + "copy_1": { + "shape": [ + 1, + 4, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 160 + }, + "transpose_9": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "select_9": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "slice_scatter_1": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "select_scatter_1": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "transpose_10": { + "shape": [ + 3, + 1, + 32, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "transpose_12": { + "shape": [ + 3, + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1536 + }, + "select_11": { + "shape": [ + 1, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "cat": { + "shape": [ + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cos": { + "shape": [ + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul": { + "shape": [ + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "sin": { + "shape": [ + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_1": { + "shape": [ + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "pow_1": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_2": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_1": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_13": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_1": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_2": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_3": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_1": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_10": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_4": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_11": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_12": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_14": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_13": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_14": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_15": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_1": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_2": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_3": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_2": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_4": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_5": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_1": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_3": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_1": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_6": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_7": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_2": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_4": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_2": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_8": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_16": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_17": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_15": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_4": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_5": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_2": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_1": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_5": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_3": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_9": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_10": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_1": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_11": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_6": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_4": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_6": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_2": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_7": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_4": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_12": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_8": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_13": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_1": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_5": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_2": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_6": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_14": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_7": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_9": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_4": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_3": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_10": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_5": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_15": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_11": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_16": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_2": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_8": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_16": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_9": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_7": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_10": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_11": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_2": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_18": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_1": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_5": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_1": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_19": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_3": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_20": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_17": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_21": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_22": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_23": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_8": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_9": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_10": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_1": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_1": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_1": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_12": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_1": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_17": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_18": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_3": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_13": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_6": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_19": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_20": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_4": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_14": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_7": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_21": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_1": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_24": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_25": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_18": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_1": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_11": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_12": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_5": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_4": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_15": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_8": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_22": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_23": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_4": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_24": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_13": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_12": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_16": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_6": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_5": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_17": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_9": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_25": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_18": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_26": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_13": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_5": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_14": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_27": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_15": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_19": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_7": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_6": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_20": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_10": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_28": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_21": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_29": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_4": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_16": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_19": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_17": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_14": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_18": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_19": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_3": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_26": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_2": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_6": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_2": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_27": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_6": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_28": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_20": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_29": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_30": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_31": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_15": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_16": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_17": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_2": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_2": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_2": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_22": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_2": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_30": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_31": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_5": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_23": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_11": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_32": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_33": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_6": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_24": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_12": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_34": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_2": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_32": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_33": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_21": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_2": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_18": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_19": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_8": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_7": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_25": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_13": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_35": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_36": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_7": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_37": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_20": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_20": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_26": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_9": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_8": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_27": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_14": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_38": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_28": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_39": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_5": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_21": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_8": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_22": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_40": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_23": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_29": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_10": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_9": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_30": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_15": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_41": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_31": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_42": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_6": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_24": { + "shape": [ + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "view_21": { + "shape": [ + 1, + 4, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_34": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_35": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_3": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "_unsafe_view": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_22": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_11": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_10": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_32": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_16": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_43": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_33": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_44": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_7": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_22": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_25": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_23": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "pow_12": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mean_11": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "add_34": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "rsqrt_17": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "mul_45": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_35": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_46": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "type_as_8": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_23": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "linear_26": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_24": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_24": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "unsqueeze_7": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "unsqueeze_8": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_36": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_37": { + "shape": [ + 1, + 8, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "slice_38": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_39": { + "shape": [ + 1, + 2, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "mul_47": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_40": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_41": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_3": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_4": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_48": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_36": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_49": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_42": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_43": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "neg_4": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_5": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_50": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_37": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat_6": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_7": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cache_update": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_1": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_9": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_1": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_4": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_1": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_10": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_2": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_5": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_2": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_25": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_1": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_51": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_38": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "softmax": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "matmul_2": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_26": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_6": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_25": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_52": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_27": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_39": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_13": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_12": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_40": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_18": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_53": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_41": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_54": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_9": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_28": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_9": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_29": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_55": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_30": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_42": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_14": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_13": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_43": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_19": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_56": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_44": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_57": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_10": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_31": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_27": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_32": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_26": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_33": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_34": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_8": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_3": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_11": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_3": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_45": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_10": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_46": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_28": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_47": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_48": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_49": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_27": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_28": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_29": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_4": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_3": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_5": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_45": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_3": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_58": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_59": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_7": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_46": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_20": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_60": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_61": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_8": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_47": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_21": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_62": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_3": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_50": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_51": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_29": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_7": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_30": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_31": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_15": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_14": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_48": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_22": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_63": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_64": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_11": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_65": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_32": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_35": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_49": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_16": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_15": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_50": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_23": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_66": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_51": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_67": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_11": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_36": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_12": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_37": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_68": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_38": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_52": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_17": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_16": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_53": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_24": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_69": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_54": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_70": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_12": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_39": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_30": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_40": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_33": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_41": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_42": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_9": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_52": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_4": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_12": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_4": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_53": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_13": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_54": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_31": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_55": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_56": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_57": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_34": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_35": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_36": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_5": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_4": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_6": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_55": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_4": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_71": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_72": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_9": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_56": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_25": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_73": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_74": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_10": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_57": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_26": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_75": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_4": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_58": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_59": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_32": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_8": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_37": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_38": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_18": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_17": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_58": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_27": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_76": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_77": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_14": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_78": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_39": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_43": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_59": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_19": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_18": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_60": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_28": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_79": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_61": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_80": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_13": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_44": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_15": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_45": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_81": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_46": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_62": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_20": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_19": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_63": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_29": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_82": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_64": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_83": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_14": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_47": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_33": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_48": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_40": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_49": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_50": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_10": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_60": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_5": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_13": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_5": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_61": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_16": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_62": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_34": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_63": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_64": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_65": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_41": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_42": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_43": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_6": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_5": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_7": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_65": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_5": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_84": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_85": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_11": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_66": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_30": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_86": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_87": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_12": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_67": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_31": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_88": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_5": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_66": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_67": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_35": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_9": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_44": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_45": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_21": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_20": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_68": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_32": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_89": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_90": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_17": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_91": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_46": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_51": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_69": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_22": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_21": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_70": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_33": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_92": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_71": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_93": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_15": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_52": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_18": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_53": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_94": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_54": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_72": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_23": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_22": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_73": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_34": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_95": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_74": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_96": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_16": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_55": { + "shape": [ + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "view_47": { + "shape": [ + 1, + 4, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_68": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_69": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_10": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "_unsafe_view_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_48": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_24": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_23": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_75": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_35": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_97": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_76": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_98": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_17": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_36": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_56": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_49": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "pow_25": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mean_24": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "add_77": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "rsqrt_36": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "mul_99": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_78": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_100": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "type_as_18": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_37": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "linear_57": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_50": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_38": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "unsqueeze_14": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "unsqueeze_15": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_70": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_71": { + "shape": [ + 1, + 8, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "slice_72": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_73": { + "shape": [ + 1, + 2, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "mul_101": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_74": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_75": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_8": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_11": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_102": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_79": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_103": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_76": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_77": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "neg_9": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_12": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_104": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_80": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat_13": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_14": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cache_update_2": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_3": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_16": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_3": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_11": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_4": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_17": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_4": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_12": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_5": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_39": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_3": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_105": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_81": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "softmax_1": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "matmul_4": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_40": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_13": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_51": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_7": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_106": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_58": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_82": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_26": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_25": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_83": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_37": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_107": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_84": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_108": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_19": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_59": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_19": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_60": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_109": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_61": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_85": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_27": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_26": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_86": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_38": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_110": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_87": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_111": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_20": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_62": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_41": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_63": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_52": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_64": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_65": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_15": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_78": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_6": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_18": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_6": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_79": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_20": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_80": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_42": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_81": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_82": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_83": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_53": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_54": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_55": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_8": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_6": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_10": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_88": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_6": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_112": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_113": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_13": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_89": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_39": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_114": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_115": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_14": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_90": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_40": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_116": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_6": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_84": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_85": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_43": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_14": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_56": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_57": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_28": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_27": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_91": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_41": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_117": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_118": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_21": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_119": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_58": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_66": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_92": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_29": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_28": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_93": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_42": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_120": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_94": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_121": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_21": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_67": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_22": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_68": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_122": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_69": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_95": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_30": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_29": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_96": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_43": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_123": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_97": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_124": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_22": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_70": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_71": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_59": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_72": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_73": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_16": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_86": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_7": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_19": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_7": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_87": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_23": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_88": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_45": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_89": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_90": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_91": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_60": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_61": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_62": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_9": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_7": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_11": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_98": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_7": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_125": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_126": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_15": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_99": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_44": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_127": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_128": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_16": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_100": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_45": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_129": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_7": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_92": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_93": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_46": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_15": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_63": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_64": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_31": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_30": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_101": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_46": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_130": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_131": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_24": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_132": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_65": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_74": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_102": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_32": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_31": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_103": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_47": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_133": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_104": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_134": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_23": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_75": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_25": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_76": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_135": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_77": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_105": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_33": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_32": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_106": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_48": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_136": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_107": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_137": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_24": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_78": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_47": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_79": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_66": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_80": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_81": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_17": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_94": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_8": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_20": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_8": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_95": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_26": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_96": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_48": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_97": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_98": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_99": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_67": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_68": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_69": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_10": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_8": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_12": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_108": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_8": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_138": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_139": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_17": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_109": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_49": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_140": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_141": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_18": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_110": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_50": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_142": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_8": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_100": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_101": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_49": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_16": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_70": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_71": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_34": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_33": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_111": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_51": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_143": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_144": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_27": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_145": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_72": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_82": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_112": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_35": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_34": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_113": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_52": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_146": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_114": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_147": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_25": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_83": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_28": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_84": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_148": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_85": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_115": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_36": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_35": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_116": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_53": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_149": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_117": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_150": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_26": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_86": { + "shape": [ + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "view_73": { + "shape": [ + 1, + 4, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_102": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_103": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_17": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "_unsafe_view_6": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_74": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_37": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_36": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_118": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_54": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_151": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_119": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_152": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_27": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_50": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_87": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_75": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "pow_38": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mean_37": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "add_120": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "rsqrt_55": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "mul_153": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_121": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_154": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "type_as_28": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_51": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "linear_88": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_76": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_52": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "unsqueeze_21": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "unsqueeze_22": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_104": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_105": { + "shape": [ + 1, + 8, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "slice_106": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_107": { + "shape": [ + 1, + 2, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "mul_155": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_108": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_109": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_13": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_18": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_156": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_122": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_157": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_110": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_111": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "neg_14": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_19": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_158": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_123": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat_20": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_21": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cache_update_4": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_5": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_23": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_5": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_18": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_7": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_24": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_6": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_19": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_8": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_53": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_5": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_159": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_124": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "softmax_2": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "matmul_6": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_54": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_20": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_77": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_11": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_160": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_89": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_125": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_39": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_38": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_126": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_56": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_161": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_127": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_162": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_29": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_90": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_29": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_91": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_163": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_92": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_128": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_40": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_39": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_129": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_57": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_164": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_130": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_165": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_30": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_93": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_55": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_94": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_78": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_95": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_96": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_22": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_112": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_9": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_25": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_9": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_113": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_30": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_114": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_56": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_115": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_116": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_117": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_79": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_80": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_81": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_12": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_9": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_15": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_131": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_9": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_166": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_167": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_19": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_132": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_58": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_168": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_169": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_20": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_133": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_59": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_170": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_9": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_118": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_119": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_57": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_21": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_82": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_83": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_41": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_40": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_134": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_60": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_171": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_172": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_31": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_173": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_84": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_97": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_135": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_42": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_41": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_136": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_61": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_174": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_137": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_175": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_31": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_98": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_32": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_99": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_176": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_100": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_138": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_43": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_42": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_139": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_62": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_177": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_140": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_178": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_32": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_101": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_58": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_102": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_85": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_103": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_104": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_23": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_120": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_10": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_26": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_10": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_121": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_33": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_122": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_59": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_123": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_124": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_125": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_86": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_87": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_88": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_13": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_10": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_16": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_141": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_10": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_179": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_180": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_21": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_142": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_63": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_181": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_182": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_22": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_143": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_64": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_183": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_10": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_126": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_127": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_60": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_22": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_89": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_90": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_44": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_43": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_144": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_65": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_184": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_185": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_34": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_186": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_91": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_105": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_145": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_45": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_44": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_146": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_66": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_187": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_147": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_188": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_33": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_106": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_35": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_107": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_189": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_108": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_148": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_46": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_45": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_149": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_67": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_190": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_150": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_191": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_34": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_109": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_61": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_110": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_92": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_111": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_112": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_24": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_128": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_11": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_27": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_11": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_129": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_36": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_130": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_62": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_131": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_132": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_133": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_93": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_94": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_95": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_14": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_11": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_17": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_151": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_11": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_192": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_193": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_23": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_152": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_68": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_194": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_195": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_24": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_153": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_69": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_196": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_11": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_134": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_135": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_63": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_23": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_96": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_97": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_47": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_46": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_154": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_70": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_197": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_198": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_37": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_199": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_98": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_113": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_155": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_48": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_47": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_156": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_71": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_200": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_157": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_201": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_35": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_114": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_38": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_115": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_202": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_116": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_158": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_49": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_48": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_159": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_72": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_203": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_160": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_204": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_36": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_117": { + "shape": [ + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "view_99": { + "shape": [ + 1, + 4, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_136": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_137": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_24": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "_unsafe_view_9": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_100": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_50": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_49": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_161": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_73": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_205": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_162": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_206": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_37": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_64": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_118": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_101": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "pow_51": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mean_50": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "add_163": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "rsqrt_74": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "mul_207": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_164": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_208": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "type_as_38": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_65": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "linear_119": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_102": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_66": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "unsqueeze_28": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "unsqueeze_29": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_138": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_139": { + "shape": [ + 1, + 8, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "slice_140": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_141": { + "shape": [ + 1, + 2, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "mul_209": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_142": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_143": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_18": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_25": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_210": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_165": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_211": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_144": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_145": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "neg_19": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_26": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_212": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_166": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat_27": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_28": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cache_update_6": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_7": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_30": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_7": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_25": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_10": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_31": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_8": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_26": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_11": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_67": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_7": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_213": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_167": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "softmax_3": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "matmul_8": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_68": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_27": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_103": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_15": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_214": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_120": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_168": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_52": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_51": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_169": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_75": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_215": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_170": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_216": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_39": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_121": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_39": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_122": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_217": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_123": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_171": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_53": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_52": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_172": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_76": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_218": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_173": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_219": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_40": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_124": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_69": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_125": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_104": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_126": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_127": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_29": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_146": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_12": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_32": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_12": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_147": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_40": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_148": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_70": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_149": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_150": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_151": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_105": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_106": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_107": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_16": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_12": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_20": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_174": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_12": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_220": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_221": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_25": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_175": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_77": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_222": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_223": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_26": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_176": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_78": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_224": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_12": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_152": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_153": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_71": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_28": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_108": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_109": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_54": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_53": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_177": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_79": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_225": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_226": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_41": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_227": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_110": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_128": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_178": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_55": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_54": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_179": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_80": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_228": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_180": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_229": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_41": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_129": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_42": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_130": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_230": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_131": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_181": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_56": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_55": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_182": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_81": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_231": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_183": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_232": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_42": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_132": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_72": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_133": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_111": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_134": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_135": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_30": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_154": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_13": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_33": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_13": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_155": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_43": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_156": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_73": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_157": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_158": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_159": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_112": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_113": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_114": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_17": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_13": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_21": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_184": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_13": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_233": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_234": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_27": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_185": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_82": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_235": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_236": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_28": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_186": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_83": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_237": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_13": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_160": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_161": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_74": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_29": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_115": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_116": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_57": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_56": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_187": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_84": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_238": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_239": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_44": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_240": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_117": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_136": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_188": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_58": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_57": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_189": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_85": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_241": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_190": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_242": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_43": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_137": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_45": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_138": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_243": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_139": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_191": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_59": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_58": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_192": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_86": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_244": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_193": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_245": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_44": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_140": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_75": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_141": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_118": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_142": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_143": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_31": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_162": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_14": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_34": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_14": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_163": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_46": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_164": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_76": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_165": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_166": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_167": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_119": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_120": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_121": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_18": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_14": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_22": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_194": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_14": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_246": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_247": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_29": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_195": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_87": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_248": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_249": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_30": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_196": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_88": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_250": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_14": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_168": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_169": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_77": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_30": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_122": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_123": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_60": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_59": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_197": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_89": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_251": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_252": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_47": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_253": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_124": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_144": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_198": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_61": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_60": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_199": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_90": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_254": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_200": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_255": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_45": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_145": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_48": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_146": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_256": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_147": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_201": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_62": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_61": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_202": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_91": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_257": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_203": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_258": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_46": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_148": { + "shape": [ + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "view_125": { + "shape": [ + 1, + 4, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_170": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_171": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_31": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "_unsafe_view_12": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_126": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_63": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_62": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_204": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_92": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_259": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_205": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_260": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_47": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_78": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_149": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_127": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "pow_64": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mean_63": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "add_206": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "rsqrt_93": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "mul_261": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_207": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_262": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "type_as_48": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_79": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "linear_150": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_128": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_80": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "unsqueeze_35": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "unsqueeze_36": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_172": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_173": { + "shape": [ + 1, + 8, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "slice_174": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_175": { + "shape": [ + 1, + 2, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "mul_263": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_176": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_177": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_23": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_32": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_264": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_208": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_265": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_178": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_179": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "neg_24": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_33": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_266": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_209": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat_34": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_35": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cache_update_8": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_9": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_37": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_9": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_32": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_13": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_38": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_10": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_33": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_14": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_81": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_9": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_267": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_210": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "softmax_4": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "matmul_10": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_82": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_34": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_129": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_19": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_268": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_151": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_211": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_65": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_64": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_212": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_94": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_269": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_213": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_270": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_49": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_152": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_49": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_153": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_271": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_154": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_214": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_66": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_65": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_215": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_95": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_272": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_216": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_273": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_50": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_155": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_83": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_156": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_130": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_157": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_158": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_36": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_180": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_15": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_39": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_15": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_181": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_50": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_182": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_84": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_183": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_184": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_185": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_131": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_132": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_133": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_20": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_15": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_25": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_217": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_15": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_274": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_275": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_31": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_218": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_96": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_276": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_277": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_32": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_219": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_97": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_278": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_15": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_186": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_187": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_85": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_35": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_134": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_135": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_67": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_66": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_220": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_98": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_279": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_280": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_51": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_281": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_136": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_159": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_221": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_68": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_67": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_222": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_99": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_282": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_223": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_283": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_51": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_160": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_52": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_161": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_284": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_162": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_224": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_69": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_68": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_225": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_100": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_285": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_226": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_286": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_52": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_163": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_86": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_164": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_137": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_165": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_166": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_37": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_188": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_16": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_40": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_16": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_189": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_53": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_190": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_87": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_191": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_192": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_193": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_138": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_139": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_140": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_21": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_16": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_26": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_227": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_16": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_287": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_288": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_33": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_228": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_101": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_289": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_290": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_34": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_229": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_102": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_291": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_16": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_194": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_195": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_88": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_36": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_141": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_142": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_70": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_69": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_230": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_103": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_292": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_293": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_54": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_294": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_143": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_167": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_231": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_71": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_70": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_232": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_104": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_295": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_233": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_296": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_53": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_168": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_55": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_169": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_297": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_170": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_234": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_72": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_71": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_235": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_105": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_298": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_236": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_299": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_54": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_171": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_89": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_172": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_144": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_173": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "linear_174": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "cat_38": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_196": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_17": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_41": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_17": { + "shape": [ + 1, + 6144, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 270336 + }, + "slice_197": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "silu_56": { + "shape": [ + 1, + 6144, + 8 + ], + "dtype": "float32", + "role": "value", + "byteLength": 196608 + }, + "slice_198": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "transpose_90": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "slice_199": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_200": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_201": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_145": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_146": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_147": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_22": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "exp_17": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_27": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_237": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "softplus_17": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_300": { + "shape": [ + 1, + 4, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_301": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_35": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_238": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_106": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_302": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_303": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sum_36": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_239": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_107": { + "shape": [ + 1, + 4, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_304": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "normalized_gated_delta_rule_17": { + "shape": [ + 1, + 16, + 132, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1081344 + }, + "slice_202": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_203": { + "shape": [ + 1, + 16, + 4, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_91": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_37": { + "shape": [ + 1, + 4, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_148": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_149": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_73": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_72": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_240": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_108": { + "shape": [ + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_305": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_306": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "silu_57": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_307": { + "shape": [ + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_150": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_175": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_241": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_74": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_73": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_242": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_109": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_308": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_243": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_309": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_55": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_176": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_58": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_177": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_310": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_178": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_244": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_75": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_74": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_245": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_110": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_311": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_246": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_312": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_56": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_179": { + "shape": [ + 1, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "view_151": { + "shape": [ + 1, + 4, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_204": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_205": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_38": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "_unsafe_view_15": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_152": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_76": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_75": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "add_247": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "rsqrt_111": { + "shape": [ + 1, + 4, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "mul_313": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_248": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_314": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_57": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_92": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_180": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_153": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "pow_77": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mean_76": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "add_249": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "rsqrt_112": { + "shape": [ + 1, + 4, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32 + }, + "mul_315": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_250": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_316": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "type_as_58": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_93": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "linear_181": { + "shape": [ + 1, + 4, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "view_154": { + "shape": [ + 1, + 4, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "transpose_94": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "unsqueeze_42": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "unsqueeze_43": { + "shape": [ + 1, + 1, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_206": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_207": { + "shape": [ + 1, + 8, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "slice_208": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_209": { + "shape": [ + 1, + 2, + 4, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 6144 + }, + "mul_317": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_210": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "slice_211": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "neg_28": { + "shape": [ + 1, + 8, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_39": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_318": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "add_251": { + "shape": [ + 1, + 8, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_319": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "slice_212": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "slice_213": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "neg_29": { + "shape": [ + 1, + 2, + 4, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "cat_40": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_320": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_252": { + "shape": [ + 1, + 2, + 4, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "cat_41": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_42": { + "shape": [ + 1, + 2, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cache_update_10": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_11": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_44": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_11": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_39": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_16": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_45": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_12": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_40": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_17": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_95": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_11": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_321": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_253": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "softmax_5": { + "shape": [ + 1, + 8, + 4, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "matmul_12": { + "shape": [ + 1, + 8, + 4, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "transpose_96": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "clone_41": { + "shape": [ + 1, + 4, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "view_155": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "sigmoid_23": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_322": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_182": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_254": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_78": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_77": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_255": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_113": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_323": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_256": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_324": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_59": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_183": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "silu_59": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_184": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_325": { + "shape": [ + 1, + 4, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "linear_185": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_257": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "pow_79": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mean_78": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "add_258": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "rsqrt_114": { + "shape": [ + 1, + 4, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16 + }, + "mul_326": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_259": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_327": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "type_as_60": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "alias": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_186": { + "shape": [ + 1, + 4, + 248320 + ], + "dtype": "float32", + "role": "value", + "byteLength": 3973120 + }, + "p_model_model_language_model_embed_tokens_weight__rows_0_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 0 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00000.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00001.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_0": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 134217728 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00002.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00003.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_1": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 268435456 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00004.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00005.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_2": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 402653184 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00006.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00007.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 536870912 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00008.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00009.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_4": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 671088640 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00010.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00011.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_5": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 805306368 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00012.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00013.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_6": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944": { + "shape": [ + 18944, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 77594624, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 939524096 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00014.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00015.bin", + "offset": 0, + "byteLength": 10485760 + } + ] + }, + "embedding__part_7": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "embedding__sum_0": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "embedding__sum_1": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "embedding__sum_2": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "embedding__sum_3": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "embedding__sum_4": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "embedding__sum_5": { + "shape": [ + 1, + 4, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "linear_186__part_0": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_1": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_2": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_3": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_4": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_5": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_6": { + "shape": [ + 1, + 4, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_7": { + "shape": [ + 1, + 4, + 18944 + ], + "dtype": "float32", + "role": "value", + "byteLength": 303104 + }, + "linear_186__cat_0_0": { + "shape": [ + 1, + 4, + 229376 + ], + "dtype": "float32", + "role": "value", + "byteLength": 3670016 + }, + "linear_186__cat_0_7": { + "shape": [ + 1, + 4, + 18944 + ], + "dtype": "float32", + "role": "value", + "byteLength": 303104 + } + }, + "nodes": [ + { + "id": "embedding", + "op": "aten.embedding.default", + "args": [ + { + "tensor": "p_model_model_language_model_embed_tokens_weight" + }, + { + "tensor": "input_ids" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 146, in forward\n text_embedding = self.model.get_input_embeddings()(input_ids)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "where", + "op": "aten.where.self", + "args": [ + { + "tensor": "is_image" + }, + { + "tensor": "image_embedding" + }, + { + "tensor": "embedding" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 147, in forward\n embedding = torch.where(is_image, image_embedding, text_embedding)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_1", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "position_ids" + }, + 0, + 1, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1183, in forward\n position_ids = position_ids[1:]\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "b_model_model_language_model_rotary_emb_inv_freq" + }, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 5, in forward\n unsqueeze = torch.ops.aten.unsqueeze.default(b_model_model_language_model_rotary_emb_inv_freq, 0); b_model_model_language_model_rotary_emb_inv_freq = None" + }, + { + "id": "unsqueeze_1", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "unsqueeze" + }, + 1 + ], + "kwargs": {}, + "source": "File \".49\", line 6, in forward\n unsqueeze_1 = torch.ops.aten.unsqueeze.default(unsqueeze, 1); unsqueeze = None" + }, + { + "id": "unsqueeze_2", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "unsqueeze_1" + }, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 7, in forward\n unsqueeze_2 = torch.ops.aten.unsqueeze.default(unsqueeze_1, 3); unsqueeze_1 = None" + }, + { + "id": "expand", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_2" + }, + [ + 3, + 1, + -1, + 1 + ] + ], + "kwargs": {}, + "source": "File \".49\", line 10, in forward\n expand = torch.ops.aten.expand.default(to, [3, 1, -1, 1]); to = None" + }, + { + "id": "unsqueeze_3", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "slice_1" + }, + 2 + ], + "kwargs": {}, + "source": "File \".49\", line 13, in forward\n unsqueeze_3 = torch.ops.aten.unsqueeze.default(slice_1, 2); slice_1 = None" + }, + { + "id": "_to_copy", + "op": "aten._to_copy.default", + "args": [ + { + "tensor": "unsqueeze_3" + } + ], + "kwargs": { + "dtype": { + "dtype": "float32" + } + }, + "source": "File \".49\", line 15, in forward\n to_2 = torch.ops.aten.to.dtype(unsqueeze_3, torch.float32); unsqueeze_3 = None" + }, + { + "id": "matmul", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "expand" + }, + { + "tensor": "_to_copy" + } + ], + "kwargs": {}, + "source": "File \".49\", line 20, in forward\n matmul = torch.ops.aten.matmul.default(to_3, to_4); to_3 = to_4 = None" + }, + { + "id": "transpose", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 21, in forward\n transpose = torch.ops.aten.transpose.int(matmul, 2, 3); matmul = None" + }, + { + "id": "select", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "select_1", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose" + }, + 0, + 1 + ], + "kwargs": {}, + "source": "File \".49\", line 23, in forward\n select_1 = torch.ops.aten.select.int(transpose, 0, 1)" + }, + { + "id": "slice_2", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_1" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 24, in forward\n slice_2 = torch.ops.aten.slice.Tensor(select_1, 2, 1, 33, 3); select_1 = None" + }, + { + "id": "slice_3", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 25, in forward\n slice_3 = torch.ops.aten.slice.Tensor(select, 2, 1, 33, 3)" + }, + { + "id": "copy", + "op": "aten.copy.default", + "args": [ + { + "tensor": "slice_3" + }, + { + "tensor": "slice_2" + } + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_1", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "select_2", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_1" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "slice_scatter", + "op": "aten.slice_scatter.default", + "args": [ + { + "tensor": "select_2" + }, + { + "tensor": "copy" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "select_scatter", + "op": "aten.select_scatter.default", + "args": [ + { + "tensor": "transpose_1" + }, + { + "tensor": "slice_scatter" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_2", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "select_scatter" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_7", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "select_7", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_7" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "slice_7", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_7" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "transpose_8", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "select_8", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_8" + }, + 0, + 2 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "slice_8", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_8" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "copy_1", + "op": "aten.copy.default", + "args": [ + { + "tensor": "slice_7" + }, + { + "tensor": "slice_8" + } + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_9", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "select_9", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_9" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "slice_scatter_1", + "op": "aten.slice_scatter.default", + "args": [ + { + "tensor": "select_9" + }, + { + "tensor": "copy_1" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "select_scatter_1", + "op": "aten.select_scatter.default", + "args": [ + { + "tensor": "transpose_9" + }, + { + "tensor": "slice_scatter_1" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_10", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "select_scatter_1" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_12", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_10" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "select_11", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_12" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "cat", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "select_11" + }, + { + "tensor": "select_11" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \".49\", line 31, in forward\n cat = torch.ops.aten.cat.default([select, select], -1); select = None" + }, + { + "id": "cos", + "op": "aten.cos.default", + "args": [ + { + "tensor": "cat" + } + ], + "kwargs": {}, + "source": "File \".49\", line 32, in forward\n cos = torch.ops.aten.cos.default(cat)" + }, + { + "id": "mul", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cos" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \".49\", line 33, in forward\n mul = torch.ops.aten.mul.Tensor(cos, 1.0); cos = None" + }, + { + "id": "sin", + "op": "aten.sin.default", + "args": [ + { + "tensor": "cat" + } + ], + "kwargs": {}, + "source": "File \".49\", line 34, in forward\n sin = torch.ops.aten.sin.default(cat); cat = None" + }, + { + "id": "mul_1", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "sin" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \".49\", line 35, in forward\n mul_1 = torch.ops.aten.mul.Tensor(sin, 1.0); sin = None" + }, + { + "id": "pow_1", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "where" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_1" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_2", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "where" + }, + { + "tensor": "rsqrt" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_1", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_3", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_2" + }, + { + "tensor": "add_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_3" + }, + { + "tensor": "where" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_13", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_1", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_1" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_2", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_3", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_1", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_0" + }, + { + "tensor": "transpose_13" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_10", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_1" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_4", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_1" + }, + { + "tensor": "unsqueeze_4" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_11", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_12", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_14", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_12" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_13", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_14", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_15", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_1", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_13" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_2", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_14" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_3", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_15" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_2", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_3" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_4", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg" + }, + { + "tensor": "softplus" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_5", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_1" + }, + { + "tensor": "view_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_1", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_5" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_3", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_1" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_1", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_6", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_1" + }, + { + "tensor": "rsqrt_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_7", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_2" + }, + { + "tensor": "view_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_2", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_7" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_4", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_2" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_2", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_8", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_2" + }, + { + "tensor": "rsqrt_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_6" + }, + { + "tensor": "mul_8" + }, + { + "tensor": "view_3" + }, + { + "tensor": "mul_4" + }, + { + "tensor": "sigmoid" + }, + { + "tensor": "states_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_16", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_17", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_15", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_17" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_15" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_4", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_5", + "op": "aten.view.default", + "args": [ + { + "tensor": "view" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_2", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_4" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_1", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_2" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_5", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_1" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_3", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_9", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_4" + }, + { + "tensor": "rsqrt_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_10", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_norm_weight" + }, + { + "tensor": "mul_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_1", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_11", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_10" + }, + { + "tensor": "silu_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_6", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_11" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_4", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_6" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_6", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "where" + }, + { + "tensor": "linear_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_3", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_6" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_2", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_3" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_7", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_2" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_4", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_12", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_6" + }, + { + "tensor": "rsqrt_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_8", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_13", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_12" + }, + { + "tensor": "add_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_1", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_13" + }, + { + "tensor": "add_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_5", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_1" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_2", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_6", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_1" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_14", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_2" + }, + { + "tensor": "linear_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_7", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_14" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_9", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_6" + }, + { + "tensor": "linear_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_4", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_9" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_3", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_4" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_10", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_3" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_5", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_15", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_9" + }, + { + "tensor": "rsqrt_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_11", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_16", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_15" + }, + { + "tensor": "add_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_2", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_16" + }, + { + "tensor": "add_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_8", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_16", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_9", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_7", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_9" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_10", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_11", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_2", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_2" + }, + { + "tensor": "transpose_16" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_18", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_2" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_1", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_5", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_1", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_2" + }, + { + "tensor": "unsqueeze_5" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_19", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_1" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_3", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_20", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_3" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_17", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_20" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_21", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_22", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_23", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_8", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_21" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_9", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_22" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_10", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_23" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_1", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_1", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_1", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_12", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_11" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_1", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_17", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_1" + }, + { + "tensor": "softplus_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_18", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_8" + }, + { + "tensor": "view_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_3", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_18" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_13", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_3" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_6", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_19", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_8" + }, + { + "tensor": "rsqrt_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_20", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_9" + }, + { + "tensor": "view_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_4", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_20" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_14", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_4" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_7", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_21", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_9" + }, + { + "tensor": "rsqrt_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_1", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_19" + }, + { + "tensor": "mul_21" + }, + { + "tensor": "view_10" + }, + { + "tensor": "mul_17" + }, + { + "tensor": "sigmoid_1" + }, + { + "tensor": "states_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_24", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_1" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_25", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_1" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_18", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_25" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_1", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_18" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_11", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_1" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_12", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_7" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_5", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_11" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_4", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_5" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_15", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_4" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_8", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_22", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_11" + }, + { + "tensor": "rsqrt_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_23", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_norm_weight" + }, + { + "tensor": "mul_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_4", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_24", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_23" + }, + { + "tensor": "silu_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_13", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_24" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_12", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_13" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_16", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_9" + }, + { + "tensor": "linear_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_6", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_16" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_5", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_6" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_17", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_5" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_9", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_25", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_16" + }, + { + "tensor": "rsqrt_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_18", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_26", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_25" + }, + { + "tensor": "add_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_3", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_26" + }, + { + "tensor": "add_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_13", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_3" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_5", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_14", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_3" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_27", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_5" + }, + { + "tensor": "linear_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_15", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_27" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_19", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_16" + }, + { + "tensor": "linear_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_7", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_19" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_6", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_7" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_20", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_6" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_10", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_28", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_19" + }, + { + "tensor": "rsqrt_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_21", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_29", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_28" + }, + { + "tensor": "add_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_4", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_29" + }, + { + "tensor": "add_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_16", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_19", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_16" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_17", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_14", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_17" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_18", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_19", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_3", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_4" + }, + { + "tensor": "transpose_19" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_26", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_3" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_2", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_6", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_2" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_2", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_3" + }, + { + "tensor": "unsqueeze_6" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_27", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_2" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_6", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_28", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_6" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_20", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_28" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_29", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_30", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_31", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_15", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_29" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_16", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_30" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_17", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_31" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_2", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_2", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_2", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_22", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_19" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_2", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_30", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_2" + }, + { + "tensor": "softplus_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_31", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_15" + }, + { + "tensor": "view_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_5", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_31" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_23", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_5" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_11", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_32", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_15" + }, + { + "tensor": "rsqrt_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_33", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_16" + }, + { + "tensor": "view_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_6", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_33" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_24", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_6" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_12", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_34", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_16" + }, + { + "tensor": "rsqrt_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_2", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_32" + }, + { + "tensor": "mul_34" + }, + { + "tensor": "view_17" + }, + { + "tensor": "mul_30" + }, + { + "tensor": "sigmoid_2" + }, + { + "tensor": "states_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_32", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_2" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_33", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_2" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_21", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_33" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_2", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_21" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_18", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_2" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_19", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_14" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_8", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_18" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_7", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_8" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_25", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_7" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_13", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_35", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_18" + }, + { + "tensor": "rsqrt_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_36", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_norm_weight" + }, + { + "tensor": "mul_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_7", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_37", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_36" + }, + { + "tensor": "silu_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_20", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_37" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_20", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_20" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_26", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_19" + }, + { + "tensor": "linear_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_9", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_26" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_8", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_9" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_27", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_8" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_14", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_38", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_26" + }, + { + "tensor": "rsqrt_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_28", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_39", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_38" + }, + { + "tensor": "add_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_5", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_39" + }, + { + "tensor": "add_26" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_21", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_5" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_8", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_22", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_5" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_40", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_8" + }, + { + "tensor": "linear_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_23", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_40" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_29", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_26" + }, + { + "tensor": "linear_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_10", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_29" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_9", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_10" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_30", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_9" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_15", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_41", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_29" + }, + { + "tensor": "rsqrt_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_31", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_42", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_41" + }, + { + "tensor": "add_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_6", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_42" + }, + { + "tensor": "add_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_24", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_21", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_24" + }, + [ + 1, + 4, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_34", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_21" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_35", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_21" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_3", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_35" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_3" + }, + [ + 1, + 4, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_22", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_34" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_11", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_22" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_10", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_11" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_32", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_10" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_16", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_43", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_22" + }, + { + "tensor": "rsqrt_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_33", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_44", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_43" + }, + { + "tensor": "add_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_7", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_44" + }, + { + "tensor": "view_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_22", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_7" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_25", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_23", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_25" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_12", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_23" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_11", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_12" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_34", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_11" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_17", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_45", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_23" + }, + { + "tensor": "rsqrt_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_35", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_46", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_45" + }, + { + "tensor": "add_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_8", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_46" + }, + { + "tensor": "view_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_23", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_26", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_24", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_26" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_24", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_24" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_7", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_8", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_36", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_22" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_37", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_22" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_38", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_23" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_39", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_23" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_47", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + { + "tensor": "unsqueeze_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_40", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_41", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_3", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_4", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_3" + }, + { + "tensor": "slice_40" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_48", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_4" + }, + { + "tensor": "unsqueeze_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_36", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_47" + }, + { + "tensor": "mul_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_49", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + { + "tensor": "unsqueeze_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_42", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_43", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_4", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_5", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_4" + }, + { + "tensor": "slice_42" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_50", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_5" + }, + { + "tensor": "unsqueeze_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_37", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_49" + }, + { + "tensor": "mul_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_6", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_36" + }, + { + "tensor": "slice_37" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_7", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_37" + }, + { + "tensor": "slice_39" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_6" + }, + { + "tensor": "cat_7" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_1", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_7" + }, + { + "tensor": "transpose_24" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_9", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_1", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_9" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_4", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_1" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_1", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_4" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_10", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_1" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_2", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_10" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_5", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_2" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_2", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_5" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_25", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_1" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_1", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_6" + }, + { + "tensor": "transpose_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_51", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_1" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_38", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_51" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_38" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_2", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax" + }, + { + "tensor": "_unsafe_view_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_26", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_2" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_6", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_26" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_25", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_6" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_3", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_52", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_25" + }, + { + "tensor": "sigmoid_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_27", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_52" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_39", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_29" + }, + { + "tensor": "linear_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_13", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_39" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_12", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_13" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_40", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_12" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_18", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_40" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_53", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_39" + }, + { + "tensor": "rsqrt_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_41", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_54", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_53" + }, + { + "tensor": "add_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_9", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_54" + }, + { + "tensor": "add_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_28", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_9" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_9", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_29", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_9" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_55", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_9" + }, + { + "tensor": "linear_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_30", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_55" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_42", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_39" + }, + { + "tensor": "linear_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_14", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_42" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_13", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_14" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_43", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_13" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_19", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_56", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_42" + }, + { + "tensor": "rsqrt_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_44", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_57", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_56" + }, + { + "tensor": "add_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_10", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_57" + }, + { + "tensor": "add_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_31", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_27", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_31" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_32", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_26", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_32" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_33", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_34", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_8", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_8" + }, + { + "tensor": "transpose_27" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_44", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_8" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_3", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_11", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_3" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_3", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_8" + }, + { + "tensor": "unsqueeze_11" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_45", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_3" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_10", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_46", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_10" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_28", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_46" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_47", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_48", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_49", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_27", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_47" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_28", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_48" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_29", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_49" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_4", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_3", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_5", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_45", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_34" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_3", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_58", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_5" + }, + { + "tensor": "softplus_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_59", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_27" + }, + { + "tensor": "view_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_7", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_59" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_46", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_7" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_20", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_60", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_27" + }, + { + "tensor": "rsqrt_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_61", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_28" + }, + { + "tensor": "view_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_8", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_61" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_47", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_8" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_21", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_62", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_28" + }, + { + "tensor": "rsqrt_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_3", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_60" + }, + { + "tensor": "mul_62" + }, + { + "tensor": "view_29" + }, + { + "tensor": "mul_58" + }, + { + "tensor": "sigmoid_4" + }, + { + "tensor": "states_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_50", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_3" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_51", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_3" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_29", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_51" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_7", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_29" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_30", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_7" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_31", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_26" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_15", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_30" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_14", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_15" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_48", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_14" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_22", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_63", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_30" + }, + { + "tensor": "rsqrt_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_64", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_norm_weight" + }, + { + "tensor": "mul_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_11", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_65", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_64" + }, + { + "tensor": "silu_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_32", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_65" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_35", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_32" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_49", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_42" + }, + { + "tensor": "linear_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_16", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_49" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_15", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_16" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_50", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_15" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_23", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_66", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_49" + }, + { + "tensor": "rsqrt_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_51", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_67", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_66" + }, + { + "tensor": "add_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_11", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_67" + }, + { + "tensor": "add_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_36", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_11" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_12", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_37", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_11" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_68", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_12" + }, + { + "tensor": "linear_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_38", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_68" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_52", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_49" + }, + { + "tensor": "linear_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_17", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_52" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_16", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_17" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_53", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_16" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_24", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_69", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_52" + }, + { + "tensor": "rsqrt_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_54", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_70", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_69" + }, + { + "tensor": "add_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_12", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_70" + }, + { + "tensor": "add_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_39", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_30", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_39" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_40", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_33", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_40" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_41", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_42", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_9", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_10" + }, + { + "tensor": "transpose_30" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_52", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_9" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_4", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_12", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_4" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_4", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_9" + }, + { + "tensor": "unsqueeze_12" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_53", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_4" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_13", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_54", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_13" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_31", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_54" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_55", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_56", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_57", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_34", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_55" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_35", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_56" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_36", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_57" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_5", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_4", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_6", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_55", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_42" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_4", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_55" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_71", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_6" + }, + { + "tensor": "softplus_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_72", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_34" + }, + { + "tensor": "view_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_9", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_72" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_56", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_9" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_25", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_56" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_73", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_34" + }, + { + "tensor": "rsqrt_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_74", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_35" + }, + { + "tensor": "view_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_10", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_74" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_57", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_10" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_26", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_75", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_35" + }, + { + "tensor": "rsqrt_26" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_4", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_73" + }, + { + "tensor": "mul_75" + }, + { + "tensor": "view_36" + }, + { + "tensor": "mul_71" + }, + { + "tensor": "sigmoid_5" + }, + { + "tensor": "states_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_58", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_4" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_59", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_4" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_32", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_59" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_8", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_32" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_37", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_8" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_38", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_33" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_18", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_37" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_17", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_18" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_58", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_17" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_27", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_76", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_37" + }, + { + "tensor": "rsqrt_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_77", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_norm_weight" + }, + { + "tensor": "mul_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_14", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_78", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_77" + }, + { + "tensor": "silu_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_39", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_78" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_43", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_39" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_59", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_52" + }, + { + "tensor": "linear_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_19", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_59" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_18", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_19" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_60", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_18" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_28", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_79", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_59" + }, + { + "tensor": "rsqrt_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_61", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_80", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_79" + }, + { + "tensor": "add_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_13", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_80" + }, + { + "tensor": "add_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_44", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_13" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_15", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_45", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_13" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_81", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_15" + }, + { + "tensor": "linear_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_46", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_81" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_62", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_59" + }, + { + "tensor": "linear_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_20", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_62" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_19", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_20" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_63", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_19" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_29", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_82", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_62" + }, + { + "tensor": "rsqrt_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_64", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_83", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_82" + }, + { + "tensor": "add_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_14", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_83" + }, + { + "tensor": "add_62" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_47", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_33", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_47" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_48", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_40", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_48" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_49", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_50", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_10", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_12" + }, + { + "tensor": "transpose_33" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_60", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_10" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_5", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_13", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_5" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_5", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_10" + }, + { + "tensor": "unsqueeze_13" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_61", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_5" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_16", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_62", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_16" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_34", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_62" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_63", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_64", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_65", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_41", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_63" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_42", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_64" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_43", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_65" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_6", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_5", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_7", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_65", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_50" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_5", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_65" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_84", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_7" + }, + { + "tensor": "softplus_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_85", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_41" + }, + { + "tensor": "view_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_11", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_85" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_66", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_11" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_30", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_86", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_41" + }, + { + "tensor": "rsqrt_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_87", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_42" + }, + { + "tensor": "view_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_12", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_87" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_67", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_12" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_31", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_88", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_42" + }, + { + "tensor": "rsqrt_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_5", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_86" + }, + { + "tensor": "mul_88" + }, + { + "tensor": "view_43" + }, + { + "tensor": "mul_84" + }, + { + "tensor": "sigmoid_6" + }, + { + "tensor": "states_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_66", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_5" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_67", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_5" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_35", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_67" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_9", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_35" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_44", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_9" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_45", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_40" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_21", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_44" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_20", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_21" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_68", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_20" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_32", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_89", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_44" + }, + { + "tensor": "rsqrt_32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_90", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_norm_weight" + }, + { + "tensor": "mul_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_17", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_91", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_90" + }, + { + "tensor": "silu_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_46", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_91" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_51", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_46" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_69", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_62" + }, + { + "tensor": "linear_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_22", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_69" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_21", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_22" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_70", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_21" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_33", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_70" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_92", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_69" + }, + { + "tensor": "rsqrt_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_71", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_93", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_92" + }, + { + "tensor": "add_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_15", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_93" + }, + { + "tensor": "add_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_52", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_15" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_18", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_53", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_15" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_94", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_18" + }, + { + "tensor": "linear_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_54", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_94" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_72", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_69" + }, + { + "tensor": "linear_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_23", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_72" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_22", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_23" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_73", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_22" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_34", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_73" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_95", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_72" + }, + { + "tensor": "rsqrt_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_74", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_96", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_95" + }, + { + "tensor": "add_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_16", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_96" + }, + { + "tensor": "add_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_55", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_47", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_55" + }, + [ + 1, + 4, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_68", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_47" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_69", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_47" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_10", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_69" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_3", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_10" + }, + [ + 1, + 4, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_48", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_68" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_24", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_48" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_23", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_24" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_75", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_23" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_35", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_97", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_48" + }, + { + "tensor": "rsqrt_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_76", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_98", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_97" + }, + { + "tensor": "add_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_17", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_98" + }, + { + "tensor": "view_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_36", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_17" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_56", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_49", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_56" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_25", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_49" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_24", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_25" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_77", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_24" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_36", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_99", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_49" + }, + { + "tensor": "rsqrt_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_78", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_100", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_99" + }, + { + "tensor": "add_78" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_18", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_100" + }, + { + "tensor": "view_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_37", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_18" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_57", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_50", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_57" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_38", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_50" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_14", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_15", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_70", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_36" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_71", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_36" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_72", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_37" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_73", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_37" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_101", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + { + "tensor": "unsqueeze_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_74", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_75", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_8", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_11", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_8" + }, + { + "tensor": "slice_74" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_102", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_11" + }, + { + "tensor": "unsqueeze_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_79", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_101" + }, + { + "tensor": "mul_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_103", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + { + "tensor": "unsqueeze_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_76", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_77", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_9", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_12", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_9" + }, + { + "tensor": "slice_76" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_104", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_12" + }, + { + "tensor": "unsqueeze_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_80", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_103" + }, + { + "tensor": "mul_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_13", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_79" + }, + { + "tensor": "slice_71" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_14", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_80" + }, + { + "tensor": "slice_73" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_2", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_14" + }, + { + "tensor": "cat_14" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_3", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_15" + }, + { + "tensor": "transpose_38" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_16", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_2" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_3", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_16" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_11", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_3" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_4", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_11" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_17", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_3" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_4", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_17" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_12", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_4" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_5", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_12" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_39", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_4" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_3", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_13" + }, + { + "tensor": "transpose_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_105", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_3" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_81", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_105" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_1", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_81" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_4", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_1" + }, + { + "tensor": "_unsafe_view_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_40", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_4" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_13", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_40" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_51", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_13" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_7", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_106", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_51" + }, + { + "tensor": "sigmoid_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_58", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_106" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_82", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_72" + }, + { + "tensor": "linear_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_26", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_82" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_25", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_26" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_83", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_25" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_37", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_107", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_82" + }, + { + "tensor": "rsqrt_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_84", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_108", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_107" + }, + { + "tensor": "add_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_19", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_108" + }, + { + "tensor": "add_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_59", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_19" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_19", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_60", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_19" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_109", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_19" + }, + { + "tensor": "linear_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_61", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_109" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_85", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_82" + }, + { + "tensor": "linear_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_27", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_85" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_26", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_27" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_86", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_26" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_38", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_110", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_85" + }, + { + "tensor": "rsqrt_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_87", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_111", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_110" + }, + { + "tensor": "add_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_20", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_111" + }, + { + "tensor": "add_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_62", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_41", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_62" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_63", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_52", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_63" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_64", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_65", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_15", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_16" + }, + { + "tensor": "transpose_41" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_78", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_15" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_6", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_18", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_6" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_6", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_15" + }, + { + "tensor": "unsqueeze_18" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_79", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_6" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_20", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_80", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_20" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_42", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_80" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_81", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_82", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_83", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_53", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_81" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_54", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_82" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_55", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_83" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_8", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_6", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_10", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_88", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_65" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_6", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_88" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_112", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_10" + }, + { + "tensor": "softplus_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_113", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_53" + }, + { + "tensor": "view_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_13", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_113" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_89", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_13" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_39", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_114", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_53" + }, + { + "tensor": "rsqrt_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_115", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_54" + }, + { + "tensor": "view_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_14", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_115" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_90", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_14" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_40", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_116", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_54" + }, + { + "tensor": "rsqrt_40" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_6", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_114" + }, + { + "tensor": "mul_116" + }, + { + "tensor": "view_55" + }, + { + "tensor": "mul_112" + }, + { + "tensor": "sigmoid_8" + }, + { + "tensor": "states_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_84", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_6" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_85", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_6" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_43", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_85" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_14", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_43" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_56", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_14" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_57", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_52" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_28", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_56" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_27", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_28" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_91", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_27" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_41", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_117", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_56" + }, + { + "tensor": "rsqrt_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_118", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_norm_weight" + }, + { + "tensor": "mul_117" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_21", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_119", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_118" + }, + { + "tensor": "silu_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_58", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_119" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_66", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_58" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_92", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_85" + }, + { + "tensor": "linear_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_29", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_92" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_28", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_29" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_93", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_28" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_42", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_120", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_92" + }, + { + "tensor": "rsqrt_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_94", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_121", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_120" + }, + { + "tensor": "add_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_21", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_121" + }, + { + "tensor": "add_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_67", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_21" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_22", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_68", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_21" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_122", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_22" + }, + { + "tensor": "linear_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_69", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_122" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_95", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_92" + }, + { + "tensor": "linear_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_30", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_95" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_29", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_30" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_96", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_29" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_43", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_96" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_123", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_95" + }, + { + "tensor": "rsqrt_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_97", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_124", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_123" + }, + { + "tensor": "add_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_22", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_124" + }, + { + "tensor": "add_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_70", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_44", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_70" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_71", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_59", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_71" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_72", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_73", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_16", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_18" + }, + { + "tensor": "transpose_44" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_86", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_16" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_7", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_19", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_7" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_7", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_16" + }, + { + "tensor": "unsqueeze_19" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_87", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_7" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_23", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_88", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_23" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_45", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_88" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_89", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_90", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_91", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_60", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_89" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_61", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_90" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_62", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_91" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_9", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_7", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_11", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_98", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_73" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_7", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_125", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_11" + }, + { + "tensor": "softplus_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_126", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_60" + }, + { + "tensor": "view_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_15", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_126" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_99", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_15" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_44", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_127", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_60" + }, + { + "tensor": "rsqrt_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_128", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_61" + }, + { + "tensor": "view_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_16", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_128" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_100", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_16" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_45", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_129", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_61" + }, + { + "tensor": "rsqrt_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_7", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_127" + }, + { + "tensor": "mul_129" + }, + { + "tensor": "view_62" + }, + { + "tensor": "mul_125" + }, + { + "tensor": "sigmoid_9" + }, + { + "tensor": "states_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_92", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_7" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_93", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_7" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_46", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_93" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_15", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_46" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_63", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_15" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_64", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_59" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_31", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_63" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_30", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_31" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_101", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_30" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_46", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_130", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_63" + }, + { + "tensor": "rsqrt_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_131", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_norm_weight" + }, + { + "tensor": "mul_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_24", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_132", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_131" + }, + { + "tensor": "silu_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_65", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_132" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_74", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_65" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_102", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_95" + }, + { + "tensor": "linear_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_32", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_102" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_31", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_32" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_103", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_31" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_47", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_133", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_102" + }, + { + "tensor": "rsqrt_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_104", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_134", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_133" + }, + { + "tensor": "add_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_23", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_134" + }, + { + "tensor": "add_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_75", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_23" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_25", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_76", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_23" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_135", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_25" + }, + { + "tensor": "linear_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_77", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_135" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_105", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_102" + }, + { + "tensor": "linear_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_33", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_105" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_32", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_33" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_106", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_32" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_48", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_136", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_105" + }, + { + "tensor": "rsqrt_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_107", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_137", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_136" + }, + { + "tensor": "add_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_24", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_137" + }, + { + "tensor": "add_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_78", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_47", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_78" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_79", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_66", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_79" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_80", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_81", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_17", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_20" + }, + { + "tensor": "transpose_47" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_94", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_17" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_8", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_20", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_8" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_8", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_17" + }, + { + "tensor": "unsqueeze_20" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_95", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_8" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_26", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_96", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_26" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_48", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_96" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_97", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_98", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_99", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_67", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_97" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_68", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_98" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_69", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_99" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_10", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_8", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_12", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_108", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_81" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_8", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_138", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_12" + }, + { + "tensor": "softplus_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_139", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_67" + }, + { + "tensor": "view_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_17", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_139" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_109", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_17" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_49", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_140", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_67" + }, + { + "tensor": "rsqrt_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_141", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_68" + }, + { + "tensor": "view_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_18", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_141" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_110", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_18" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_50", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_110" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_142", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_68" + }, + { + "tensor": "rsqrt_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_8", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_140" + }, + { + "tensor": "mul_142" + }, + { + "tensor": "view_69" + }, + { + "tensor": "mul_138" + }, + { + "tensor": "sigmoid_10" + }, + { + "tensor": "states_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_100", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_8" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_101", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_8" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_49", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_101" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_16", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_49" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_70", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_16" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_71", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_66" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_34", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_70" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_33", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_34" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_111", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_33" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_51", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_143", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_70" + }, + { + "tensor": "rsqrt_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_144", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_norm_weight" + }, + { + "tensor": "mul_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_27", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_145", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_144" + }, + { + "tensor": "silu_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_72", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_145" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_82", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_72" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_112", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_105" + }, + { + "tensor": "linear_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_35", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_112" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_34", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_35" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_113", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_34" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_52", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_146", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_112" + }, + { + "tensor": "rsqrt_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_114", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_147", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_146" + }, + { + "tensor": "add_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_25", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_147" + }, + { + "tensor": "add_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_83", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_25" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_28", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_84", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_25" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_148", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_28" + }, + { + "tensor": "linear_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_85", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_148" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_115", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_112" + }, + { + "tensor": "linear_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_36", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_115" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_35", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_36" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_116", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_35" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_53", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_149", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_115" + }, + { + "tensor": "rsqrt_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_117", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_150", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_149" + }, + { + "tensor": "add_117" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_26", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_150" + }, + { + "tensor": "add_115" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_86", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_73", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_86" + }, + [ + 1, + 4, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_102", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_73" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_103", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_73" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_17", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_103" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_6", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_17" + }, + [ + 1, + 4, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_74", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_102" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_37", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_74" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_36", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_37" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_118", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_36" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_54", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_118" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_151", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_74" + }, + { + "tensor": "rsqrt_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_119", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_152", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_151" + }, + { + "tensor": "add_119" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_27", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_152" + }, + { + "tensor": "view_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_50", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_27" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_87", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_75", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_87" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_38", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_75" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_37", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_38" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_120", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_37" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_55", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_153", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_75" + }, + { + "tensor": "rsqrt_55" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_121", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_154", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_153" + }, + { + "tensor": "add_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_28", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_154" + }, + { + "tensor": "view_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_51", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_28" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_88", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_76", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_88" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_52", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_76" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_21", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_22", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_104", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_50" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_105", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_50" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_106", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_51" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_107", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_51" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_155", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + { + "tensor": "unsqueeze_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_108", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_109", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_13", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_18", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_13" + }, + { + "tensor": "slice_108" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_156", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_18" + }, + { + "tensor": "unsqueeze_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_122", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_155" + }, + { + "tensor": "mul_156" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_157", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + { + "tensor": "unsqueeze_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_110", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_111", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_14", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_19", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_14" + }, + { + "tensor": "slice_110" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_158", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_19" + }, + { + "tensor": "unsqueeze_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_123", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_157" + }, + { + "tensor": "mul_158" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_20", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_122" + }, + { + "tensor": "slice_105" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_21", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_123" + }, + { + "tensor": "slice_107" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_4", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_22" + }, + { + "tensor": "cat_21" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_5", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_23" + }, + { + "tensor": "transpose_52" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_23", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_4" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_5", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_23" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_18", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_5" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_7", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_18" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_24", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_5" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_6", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_24" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_19", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_6" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_8", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_19" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_53", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_7" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_5", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_20" + }, + { + "tensor": "transpose_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_159", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_5" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_124", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_159" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_2", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_124" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_6", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_2" + }, + { + "tensor": "_unsafe_view_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_54", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_6" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_20", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_54" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_77", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_20" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_11", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_160", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_77" + }, + { + "tensor": "sigmoid_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_89", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_160" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_125", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_115" + }, + { + "tensor": "linear_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_39", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_125" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_38", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_39" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_126", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_38" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_56", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_161", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_125" + }, + { + "tensor": "rsqrt_56" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_127", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_162", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_161" + }, + { + "tensor": "add_127" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_29", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_162" + }, + { + "tensor": "add_125" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_90", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_29" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_29", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_91", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_29" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_163", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_29" + }, + { + "tensor": "linear_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_92", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_163" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_128", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_125" + }, + { + "tensor": "linear_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_40", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_128" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_39", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_40" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_129", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_39" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_57", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_164", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_128" + }, + { + "tensor": "rsqrt_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_130", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_165", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_164" + }, + { + "tensor": "add_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_30", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_165" + }, + { + "tensor": "add_128" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_93", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_55", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_93" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_94", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_78", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_94" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_95", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_96", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_22", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_24" + }, + { + "tensor": "transpose_55" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_112", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_22" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_9", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_25", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_9" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_9", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_22" + }, + { + "tensor": "unsqueeze_25" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_113", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_9" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_30", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_114", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_30" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_56", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_114" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_115", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_116", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_117", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_79", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_115" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_80", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_116" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_81", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_117" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_12", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_9", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_15", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_131", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_96" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_9", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_166", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_15" + }, + { + "tensor": "softplus_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_167", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_79" + }, + { + "tensor": "view_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_19", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_167" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_132", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_19" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_58", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_132" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_168", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_79" + }, + { + "tensor": "rsqrt_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_169", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_80" + }, + { + "tensor": "view_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_20", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_169" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_133", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_20" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_59", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_133" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_170", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_80" + }, + { + "tensor": "rsqrt_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_9", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_168" + }, + { + "tensor": "mul_170" + }, + { + "tensor": "view_81" + }, + { + "tensor": "mul_166" + }, + { + "tensor": "sigmoid_12" + }, + { + "tensor": "states_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_118", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_9" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_119", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_9" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_57", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_119" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_21", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_57" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_82", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_21" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_83", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_78" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_41", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_82" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_40", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_41" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_134", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_40" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_60", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_134" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_171", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_82" + }, + { + "tensor": "rsqrt_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_172", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_norm_weight" + }, + { + "tensor": "mul_171" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_31", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_173", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_172" + }, + { + "tensor": "silu_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_84", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_173" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_97", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_84" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_135", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_128" + }, + { + "tensor": "linear_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_42", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_135" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_41", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_42" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_136", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_41" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_61", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_136" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_174", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_135" + }, + { + "tensor": "rsqrt_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_137", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_175", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_174" + }, + { + "tensor": "add_137" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_31", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_175" + }, + { + "tensor": "add_135" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_98", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_31" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_32", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_99", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_31" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_176", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_32" + }, + { + "tensor": "linear_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_100", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_176" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_138", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_135" + }, + { + "tensor": "linear_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_43", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_138" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_42", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_43" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_139", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_42" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_62", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_177", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_138" + }, + { + "tensor": "rsqrt_62" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_140", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_178", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_177" + }, + { + "tensor": "add_140" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_32", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_178" + }, + { + "tensor": "add_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_101", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_58", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_101" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_102", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_85", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_102" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_103", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_104", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_23", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_26" + }, + { + "tensor": "transpose_58" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_120", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_23" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_10", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_26", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_10" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_10", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_23" + }, + { + "tensor": "unsqueeze_26" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_121", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_10" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_33", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_122", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_33" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_59", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_122" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_123", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_124", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_125", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_86", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_123" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_87", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_124" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_88", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_125" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_13", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_10", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_16", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_141", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_104" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_10", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_141" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_179", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_16" + }, + { + "tensor": "softplus_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_180", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_86" + }, + { + "tensor": "view_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_21", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_180" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_142", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_21" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_63", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_181", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_86" + }, + { + "tensor": "rsqrt_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_182", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_87" + }, + { + "tensor": "view_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_22", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_182" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_143", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_22" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_64", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_183", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_87" + }, + { + "tensor": "rsqrt_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_10", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_181" + }, + { + "tensor": "mul_183" + }, + { + "tensor": "view_88" + }, + { + "tensor": "mul_179" + }, + { + "tensor": "sigmoid_13" + }, + { + "tensor": "states_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_126", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_10" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_127", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_10" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_60", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_127" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_22", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_60" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_89", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_22" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_90", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_85" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_44", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_89" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_43", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_44" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_144", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_43" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_65", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_144" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_184", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_89" + }, + { + "tensor": "rsqrt_65" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_185", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_norm_weight" + }, + { + "tensor": "mul_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_34", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_186", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_185" + }, + { + "tensor": "silu_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_91", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_186" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_105", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_91" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_145", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_138" + }, + { + "tensor": "linear_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_45", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_145" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_44", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_45" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_146", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_44" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_66", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_187", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_145" + }, + { + "tensor": "rsqrt_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_147", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_188", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_187" + }, + { + "tensor": "add_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_33", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_188" + }, + { + "tensor": "add_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_106", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_33" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_35", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_107", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_33" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_189", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_35" + }, + { + "tensor": "linear_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_108", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_189" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_148", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_145" + }, + { + "tensor": "linear_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_46", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_148" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_45", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_46" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_149", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_45" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_67", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_149" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_190", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_148" + }, + { + "tensor": "rsqrt_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_150", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_191", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_190" + }, + { + "tensor": "add_150" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_34", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_191" + }, + { + "tensor": "add_148" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_109", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_61", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_109" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_110", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_92", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_110" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_111", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_112", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_24", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_28" + }, + { + "tensor": "transpose_61" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_128", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_24" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_11", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_27", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_11" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_11", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_24" + }, + { + "tensor": "unsqueeze_27" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_129", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_11" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_36", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_130", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_36" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_62", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_130" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_131", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_132", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_133", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_93", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_131" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_94", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_132" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_95", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_133" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_14", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_11", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_17", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_151", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_112" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_11", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_151" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_192", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_17" + }, + { + "tensor": "softplus_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_193", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_93" + }, + { + "tensor": "view_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_23", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_193" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_152", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_23" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_68", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_194", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_93" + }, + { + "tensor": "rsqrt_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_195", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_94" + }, + { + "tensor": "view_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_24", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_195" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_153", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_24" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_69", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_196", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_94" + }, + { + "tensor": "rsqrt_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_11", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_194" + }, + { + "tensor": "mul_196" + }, + { + "tensor": "view_95" + }, + { + "tensor": "mul_192" + }, + { + "tensor": "sigmoid_14" + }, + { + "tensor": "states_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_134", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_11" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_135", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_11" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_63", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_135" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_23", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_63" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_96", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_23" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_97", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_92" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_47", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_96" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_46", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_47" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_154", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_46" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_70", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_154" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_197", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_96" + }, + { + "tensor": "rsqrt_70" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_198", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_norm_weight" + }, + { + "tensor": "mul_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_37", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_199", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_198" + }, + { + "tensor": "silu_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_98", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_199" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_113", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_98" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_155", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_148" + }, + { + "tensor": "linear_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_48", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_155" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_47", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_48" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_156", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_47" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_71", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_156" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_200", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_155" + }, + { + "tensor": "rsqrt_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_157", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_201", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_200" + }, + { + "tensor": "add_157" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_35", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_201" + }, + { + "tensor": "add_155" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_114", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_35" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_38", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_115", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_35" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_202", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_38" + }, + { + "tensor": "linear_115" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_116", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_202" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_158", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_155" + }, + { + "tensor": "linear_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_49", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_158" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_48", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_49" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_159", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_48" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_72", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_159" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_203", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_158" + }, + { + "tensor": "rsqrt_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_160", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_204", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_203" + }, + { + "tensor": "add_160" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_36", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_204" + }, + { + "tensor": "add_158" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_117", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_99", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_117" + }, + [ + 1, + 4, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_136", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_99" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_137", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_99" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_24", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_137" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_9", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_24" + }, + [ + 1, + 4, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_100", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_136" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_50", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_100" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_49", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_50" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_161", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_49" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_73", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_161" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_205", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_100" + }, + { + "tensor": "rsqrt_73" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_162", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_206", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_205" + }, + { + "tensor": "add_162" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_37", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_206" + }, + { + "tensor": "view_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_64", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_37" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_118", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_101", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_118" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_51", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_101" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_50", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_51" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_163", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_50" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_74", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_163" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_207", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_101" + }, + { + "tensor": "rsqrt_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_164", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_208", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_207" + }, + { + "tensor": "add_164" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_38", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_208" + }, + { + "tensor": "view_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_65", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_38" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_119", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_102", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_119" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_66", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_102" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_28", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_29", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_138", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_64" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_139", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_64" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_140", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_65" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_141", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_65" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_209", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + { + "tensor": "unsqueeze_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_142", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_143", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_18", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_25", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_18" + }, + { + "tensor": "slice_142" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_210", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_25" + }, + { + "tensor": "unsqueeze_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_165", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_209" + }, + { + "tensor": "mul_210" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_211", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + { + "tensor": "unsqueeze_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_144", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_145", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_19", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_26", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_19" + }, + { + "tensor": "slice_144" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_212", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_26" + }, + { + "tensor": "unsqueeze_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_166", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_211" + }, + { + "tensor": "mul_212" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_27", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_165" + }, + { + "tensor": "slice_139" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_28", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_166" + }, + { + "tensor": "slice_141" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_6", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_30" + }, + { + "tensor": "cat_28" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_7", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_31" + }, + { + "tensor": "transpose_66" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_30", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_6" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_7", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_30" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_25", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_7" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_10", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_25" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_31", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_7" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_8", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_31" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_26", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_8" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_11", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_26" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_67", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_10" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_7", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_27" + }, + { + "tensor": "transpose_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_213", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_7" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_167", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_213" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_3", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_167" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_8", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_3" + }, + { + "tensor": "_unsafe_view_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_68", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_27", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_68" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_103", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_27" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_15", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_214", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_103" + }, + { + "tensor": "sigmoid_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_120", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_214" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_168", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_158" + }, + { + "tensor": "linear_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_52", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_168" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_51", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_52" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_169", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_51" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_75", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_169" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_215", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_168" + }, + { + "tensor": "rsqrt_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_170", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_216", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_215" + }, + { + "tensor": "add_170" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_39", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_216" + }, + { + "tensor": "add_168" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_121", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_39" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_39", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_122", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_39" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_217", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_39" + }, + { + "tensor": "linear_122" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_123", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_217" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_171", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_168" + }, + { + "tensor": "linear_123" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_53", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_171" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_52", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_53" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_172", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_52" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_76", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_172" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_218", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_171" + }, + { + "tensor": "rsqrt_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_173", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_219", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_218" + }, + { + "tensor": "add_173" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_40", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_219" + }, + { + "tensor": "add_171" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_124", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_69", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_124" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_125", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_104", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_125" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_126", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_127", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_29", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_32" + }, + { + "tensor": "transpose_69" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_146", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_29" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_12", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_32", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_12" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_12", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_29" + }, + { + "tensor": "unsqueeze_32" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_147", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_12" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_40", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_148", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_40" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_70", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_148" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_149", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_150", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_151", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_105", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_149" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_106", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_150" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_107", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_151" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_16", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_12", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_20", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_174", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_127" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_12", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_174" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_220", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_20" + }, + { + "tensor": "softplus_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_221", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_105" + }, + { + "tensor": "view_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_25", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_221" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_175", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_25" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_77", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_175" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_222", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_105" + }, + { + "tensor": "rsqrt_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_223", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_106" + }, + { + "tensor": "view_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_26", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_223" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_176", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_26" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_78", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_176" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_224", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_106" + }, + { + "tensor": "rsqrt_78" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_12", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_222" + }, + { + "tensor": "mul_224" + }, + { + "tensor": "view_107" + }, + { + "tensor": "mul_220" + }, + { + "tensor": "sigmoid_16" + }, + { + "tensor": "states_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_152", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_12" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_153", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_12" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_71", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_153" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_28", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_71" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_108", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_28" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_109", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_104" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_54", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_108" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_53", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_54" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_177", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_53" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_79", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_225", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_108" + }, + { + "tensor": "rsqrt_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_226", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_norm_weight" + }, + { + "tensor": "mul_225" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_41", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_227", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_226" + }, + { + "tensor": "silu_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_110", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_227" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_128", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_110" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_178", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_171" + }, + { + "tensor": "linear_128" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_55", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_178" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_54", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_55" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_179", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_54" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_80", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_179" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_228", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_178" + }, + { + "tensor": "rsqrt_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_180", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_229", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_228" + }, + { + "tensor": "add_180" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_41", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_229" + }, + { + "tensor": "add_178" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_129", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_41" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_42", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_130", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_41" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_230", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_42" + }, + { + "tensor": "linear_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_131", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_230" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_181", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_178" + }, + { + "tensor": "linear_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_56", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_181" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_55", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_56" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_182", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_55" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_81", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_182" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_231", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_181" + }, + { + "tensor": "rsqrt_81" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_183", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_232", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_231" + }, + { + "tensor": "add_183" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_42", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_232" + }, + { + "tensor": "add_181" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_132", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_72", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_132" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_133", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_111", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_133" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_134", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_135", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_30", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_34" + }, + { + "tensor": "transpose_72" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_154", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_30" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_13", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_33", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_13" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_13", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_30" + }, + { + "tensor": "unsqueeze_33" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_155", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_13" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_43", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_155" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_156", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_43" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_73", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_156" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_157", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_158", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_159", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_112", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_157" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_113", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_158" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_114", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_159" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_17", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_134" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_13", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_21", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_184", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_135" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_13", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_233", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_21" + }, + { + "tensor": "softplus_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_234", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_112" + }, + { + "tensor": "view_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_27", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_234" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_185", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_27" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_82", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_185" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_235", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_112" + }, + { + "tensor": "rsqrt_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_236", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_113" + }, + { + "tensor": "view_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_28", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_236" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_186", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_28" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_83", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_186" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_237", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_113" + }, + { + "tensor": "rsqrt_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_13", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_235" + }, + { + "tensor": "mul_237" + }, + { + "tensor": "view_114" + }, + { + "tensor": "mul_233" + }, + { + "tensor": "sigmoid_17" + }, + { + "tensor": "states_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_160", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_13" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_161", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_13" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_74", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_161" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_29", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_74" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_115", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_29" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_116", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_111" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_57", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_115" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_56", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_57" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_187", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_56" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_84", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_187" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_238", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_115" + }, + { + "tensor": "rsqrt_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_239", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_norm_weight" + }, + { + "tensor": "mul_238" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_44", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_240", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_239" + }, + { + "tensor": "silu_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_117", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_240" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_136", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_117" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_188", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_181" + }, + { + "tensor": "linear_136" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_58", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_188" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_57", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_58" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_189", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_57" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_85", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_189" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_241", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_188" + }, + { + "tensor": "rsqrt_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_190", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_242", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_241" + }, + { + "tensor": "add_190" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_43", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_242" + }, + { + "tensor": "add_188" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_137", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_43" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_45", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_137" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_138", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_43" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_243", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_45" + }, + { + "tensor": "linear_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_139", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_243" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_191", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_188" + }, + { + "tensor": "linear_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_59", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_191" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_58", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_59" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_192", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_58" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_86", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_192" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_244", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_191" + }, + { + "tensor": "rsqrt_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_193", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_245", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_244" + }, + { + "tensor": "add_193" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_44", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_245" + }, + { + "tensor": "add_191" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_140", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_75", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_140" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_141", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_118", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_141" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_142", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_143", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_31", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_36" + }, + { + "tensor": "transpose_75" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_162", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_31" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_14", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_34", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_14" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_14", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_31" + }, + { + "tensor": "unsqueeze_34" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_163", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_14" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_46", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_163" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_164", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_46" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_76", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_164" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_165", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_166", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_167", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_119", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_165" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_120", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_166" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_121", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_167" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_18", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_14", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_22", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_194", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_143" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_14", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_194" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_246", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_22" + }, + { + "tensor": "softplus_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_247", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_119" + }, + { + "tensor": "view_119" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_29", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_247" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_195", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_29" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_87", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_195" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_248", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_119" + }, + { + "tensor": "rsqrt_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_249", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_120" + }, + { + "tensor": "view_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_30", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_249" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_196", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_30" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_88", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_196" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_250", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_120" + }, + { + "tensor": "rsqrt_88" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_14", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_248" + }, + { + "tensor": "mul_250" + }, + { + "tensor": "view_121" + }, + { + "tensor": "mul_246" + }, + { + "tensor": "sigmoid_18" + }, + { + "tensor": "states_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_168", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_14" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_169", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_14" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_77", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_169" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_30", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_77" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_122", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_30" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_123", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_118" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_60", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_122" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_59", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_60" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_197", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_59" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_89", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_251", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_122" + }, + { + "tensor": "rsqrt_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_252", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_norm_weight" + }, + { + "tensor": "mul_251" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_47", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_123" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_253", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_252" + }, + { + "tensor": "silu_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_124", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_253" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_144", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_124" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_198", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_191" + }, + { + "tensor": "linear_144" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_61", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_198" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_60", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_61" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_199", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_60" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_90", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_199" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_254", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_198" + }, + { + "tensor": "rsqrt_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_200", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_255", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_254" + }, + { + "tensor": "add_200" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_45", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_255" + }, + { + "tensor": "add_198" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_145", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_45" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_48", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_146", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_45" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_256", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_48" + }, + { + "tensor": "linear_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_147", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_256" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_201", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_198" + }, + { + "tensor": "linear_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_62", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_201" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_61", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_62" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_202", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_61" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_91", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_202" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_257", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_201" + }, + { + "tensor": "rsqrt_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_203", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_258", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_257" + }, + { + "tensor": "add_203" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_46", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_258" + }, + { + "tensor": "add_201" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_148", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_125", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_148" + }, + [ + 1, + 4, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_170", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_125" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_171", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_125" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_31", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_171" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_12", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_31" + }, + [ + 1, + 4, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_126", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_170" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_63", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_126" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_62", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_63" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_204", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_62" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_92", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_204" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_259", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_126" + }, + { + "tensor": "rsqrt_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_205", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_260", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_259" + }, + { + "tensor": "add_205" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_47", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_260" + }, + { + "tensor": "view_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_78", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_47" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_149", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_127", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_149" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_64", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_127" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_63", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_64" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_206", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_63" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_93", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_206" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_261", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_127" + }, + { + "tensor": "rsqrt_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_207", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_262", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_261" + }, + { + "tensor": "add_207" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_48", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_262" + }, + { + "tensor": "view_127" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_79", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_48" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_150", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_128", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_150" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_80", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_128" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_35", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_36", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_172", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_78" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_173", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_78" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_174", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_79" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_175", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_79" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_263", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + { + "tensor": "unsqueeze_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_176", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_177", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_23", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_32", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_23" + }, + { + "tensor": "slice_176" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_264", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_32" + }, + { + "tensor": "unsqueeze_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_208", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_263" + }, + { + "tensor": "mul_264" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_265", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + { + "tensor": "unsqueeze_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_178", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_179", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_24", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_179" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_33", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_24" + }, + { + "tensor": "slice_178" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_266", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_33" + }, + { + "tensor": "unsqueeze_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_209", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_265" + }, + { + "tensor": "mul_266" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_34", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_208" + }, + { + "tensor": "slice_173" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_35", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_209" + }, + { + "tensor": "slice_175" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_8", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_38" + }, + { + "tensor": "cat_35" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_9", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_39" + }, + { + "tensor": "transpose_80" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_37", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_8" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_9", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_37" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_32", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_9" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_13", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_32" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_38", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_9" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_10", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_38" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_33", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_10" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_14", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_33" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_81", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_13" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_9", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_34" + }, + { + "tensor": "transpose_81" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_267", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_9" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_210", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_267" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_4", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_210" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_10", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_4" + }, + { + "tensor": "_unsafe_view_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_82", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_10" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_34", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_82" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_129", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_34" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_19", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_268", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_129" + }, + { + "tensor": "sigmoid_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_151", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_268" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_211", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_201" + }, + { + "tensor": "linear_151" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_65", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_211" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_64", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_65" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_212", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_64" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_94", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_212" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_269", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_211" + }, + { + "tensor": "rsqrt_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_213", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_270", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_269" + }, + { + "tensor": "add_213" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_49", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_270" + }, + { + "tensor": "add_211" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_152", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_49" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_49", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_153", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_49" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_271", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_49" + }, + { + "tensor": "linear_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_154", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_271" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_214", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_211" + }, + { + "tensor": "linear_154" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_66", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_214" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_65", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_66" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_215", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_65" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_95", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_215" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_272", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_214" + }, + { + "tensor": "rsqrt_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_216", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_273", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_272" + }, + { + "tensor": "add_216" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_50", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_273" + }, + { + "tensor": "add_214" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_155", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_83", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_155" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_156", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_130", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_156" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_157", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_158", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_36", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_40" + }, + { + "tensor": "transpose_83" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_180", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_36" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_15", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_39", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_15" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_15", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_36" + }, + { + "tensor": "unsqueeze_39" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_181", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_15" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_50", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_181" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_182", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_50" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_84", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_182" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_183", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_184", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_185", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_131", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_183" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_132", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_184" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_133", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_185" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_20", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_157" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_15", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_25", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_217", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_158" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_15", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_217" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_274", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_25" + }, + { + "tensor": "softplus_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_275", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_131" + }, + { + "tensor": "view_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_31", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_275" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_218", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_31" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_96", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_218" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_276", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_131" + }, + { + "tensor": "rsqrt_96" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_277", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_132" + }, + { + "tensor": "view_132" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_32", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_277" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_219", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_32" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_97", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_219" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_278", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_132" + }, + { + "tensor": "rsqrt_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_15", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_276" + }, + { + "tensor": "mul_278" + }, + { + "tensor": "view_133" + }, + { + "tensor": "mul_274" + }, + { + "tensor": "sigmoid_20" + }, + { + "tensor": "states_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_186", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_15" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_187", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_15" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_85", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_187" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_35", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_85" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_134", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_35" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_135", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_130" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_67", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_134" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_66", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_67" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_220", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_66" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_98", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_220" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_279", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_134" + }, + { + "tensor": "rsqrt_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_280", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_norm_weight" + }, + { + "tensor": "mul_279" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_51", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_135" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_281", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_280" + }, + { + "tensor": "silu_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_136", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_281" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_159", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_136" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_221", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_214" + }, + { + "tensor": "linear_159" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_68", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_221" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_67", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_68" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_222", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_67" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_99", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_222" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_282", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_221" + }, + { + "tensor": "rsqrt_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_223", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_283", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_282" + }, + { + "tensor": "add_223" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_51", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_283" + }, + { + "tensor": "add_221" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_160", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_51" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_52", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_160" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_161", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_51" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_284", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_52" + }, + { + "tensor": "linear_161" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_162", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_284" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_224", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_221" + }, + { + "tensor": "linear_162" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_69", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_224" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_68", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_69" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_225", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_68" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_100", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_225" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_285", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_224" + }, + { + "tensor": "rsqrt_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_226", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_286", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_285" + }, + { + "tensor": "add_226" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_52", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_286" + }, + { + "tensor": "add_224" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_163", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_86", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_163" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_164", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_137", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_164" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_165", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_166", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_37", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_42" + }, + { + "tensor": "transpose_86" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_188", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_37" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_16", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_40", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_16" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_16", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_37" + }, + { + "tensor": "unsqueeze_40" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_189", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_16" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_53", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_189" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_190", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_53" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_87", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_190" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_191", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_192", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_193", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_138", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_191" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_139", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_192" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_140", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_193" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_21", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_165" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_16", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_26", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_227", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_166" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_16", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_227" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_287", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_26" + }, + { + "tensor": "softplus_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_288", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_138" + }, + { + "tensor": "view_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_33", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_288" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_228", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_33" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_101", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_228" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_289", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_138" + }, + { + "tensor": "rsqrt_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_290", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_139" + }, + { + "tensor": "view_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_34", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_290" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_229", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_34" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_102", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_229" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_291", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_139" + }, + { + "tensor": "rsqrt_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_16", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_289" + }, + { + "tensor": "mul_291" + }, + { + "tensor": "view_140" + }, + { + "tensor": "mul_287" + }, + { + "tensor": "sigmoid_21" + }, + { + "tensor": "states_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_194", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_16" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_195", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_16" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_88", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_195" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_36", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_88" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_141", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_36" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_142", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_137" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_70", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_141" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_69", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_70" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_230", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_69" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_103", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_230" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_292", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_141" + }, + { + "tensor": "rsqrt_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_293", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_norm_weight" + }, + { + "tensor": "mul_292" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_54", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_294", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_293" + }, + { + "tensor": "silu_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_143", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_294" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_167", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_143" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_231", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_224" + }, + { + "tensor": "linear_167" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_71", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_231" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_70", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_71" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_232", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_70" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_104", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_232" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_295", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_231" + }, + { + "tensor": "rsqrt_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_233", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_296", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_295" + }, + { + "tensor": "add_233" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_53", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_296" + }, + { + "tensor": "add_231" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_168", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_53" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_55", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_168" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_169", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_53" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_297", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_55" + }, + { + "tensor": "linear_169" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_170", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_297" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_234", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_231" + }, + { + "tensor": "linear_170" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_72", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_234" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_71", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_72" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_235", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_71" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_105", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_235" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_298", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_234" + }, + { + "tensor": "rsqrt_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_236", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_299", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_298" + }, + { + "tensor": "add_236" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_54", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_299" + }, + { + "tensor": "add_234" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_171", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_89", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_171" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_172", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_144", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_172" + }, + [ + 1, + 4, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_173", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_174", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_38", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_44" + }, + { + "tensor": "transpose_89" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_196", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_38" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_17", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_41", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_17" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_17", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_38" + }, + { + "tensor": "unsqueeze_41" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_197", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_17" + }, + 2, + 0, + 8 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_56", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_198", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_56" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_90", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_198" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_199", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_200", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_201", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_145", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_199" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_146", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_200" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_147", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_201" + }, + [ + 1, + 4, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_22", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_173" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_17", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_27", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_237", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_174" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_17", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_237" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_300", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_27" + }, + { + "tensor": "softplus_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_301", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_145" + }, + { + "tensor": "view_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_35", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_301" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_238", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_35" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_106", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_238" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_302", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_145" + }, + { + "tensor": "rsqrt_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_303", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_146" + }, + { + "tensor": "view_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_36", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_303" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_239", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_36" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_107", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_239" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_304", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_146" + }, + { + "tensor": "rsqrt_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_17", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_302" + }, + { + "tensor": "mul_304" + }, + { + "tensor": "view_147" + }, + { + "tensor": "mul_300" + }, + { + "tensor": "sigmoid_22" + }, + { + "tensor": "states_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_202", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_17" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_203", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_17" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_91", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_203" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_37", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_91" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_148", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_37" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_149", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_144" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_73", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_148" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_72", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_73" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_240", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_72" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_108", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_240" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_305", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_148" + }, + { + "tensor": "rsqrt_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_306", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_norm_weight" + }, + { + "tensor": "mul_305" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_57", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_149" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_307", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_306" + }, + { + "tensor": "silu_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_150", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_307" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_175", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_150" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_241", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_234" + }, + { + "tensor": "linear_175" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_74", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_241" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_73", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_74" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_242", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_73" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_109", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_242" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_308", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_241" + }, + { + "tensor": "rsqrt_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_243", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_309", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_308" + }, + { + "tensor": "add_243" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_55", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_309" + }, + { + "tensor": "add_241" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_176", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_55" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_58", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_176" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_177", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_55" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_310", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_58" + }, + { + "tensor": "linear_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_178", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_310" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_244", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_241" + }, + { + "tensor": "linear_178" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_75", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_244" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_74", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_75" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_245", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_74" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_110", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_245" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_311", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_244" + }, + { + "tensor": "rsqrt_110" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_246", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_312", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_311" + }, + { + "tensor": "add_246" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_56", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_312" + }, + { + "tensor": "add_244" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_179", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_151", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_179" + }, + [ + 1, + 4, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_204", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_151" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_205", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_151" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_38", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_205" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_15", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_38" + }, + [ + 1, + 4, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_152", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_204" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_76", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_152" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_75", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_76" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_247", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_75" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_111", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_247" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_313", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_152" + }, + { + "tensor": "rsqrt_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_248", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_314", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_313" + }, + { + "tensor": "add_248" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_57", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_314" + }, + { + "tensor": "view_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_92", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_57" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_180", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_153", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_180" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_77", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_153" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_76", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_77" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_249", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_76" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_112", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_249" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_315", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_153" + }, + { + "tensor": "rsqrt_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_250", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_316", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_315" + }, + { + "tensor": "add_250" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_58", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_316" + }, + { + "tensor": "view_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_93", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_58" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_181", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_154", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_181" + }, + [ + 1, + 4, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_94", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_154" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_42", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_43", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_206", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_92" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_207", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_92" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_208", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_93" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_209", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_93" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_317", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + { + "tensor": "unsqueeze_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_210", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_211", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_28", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_211" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_39", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_28" + }, + { + "tensor": "slice_210" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_318", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_39" + }, + { + "tensor": "unsqueeze_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_251", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_317" + }, + { + "tensor": "mul_318" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_319", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + { + "tensor": "unsqueeze_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_212", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_213", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_29", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_213" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_40", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_29" + }, + { + "tensor": "slice_212" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_320", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_40" + }, + { + "tensor": "unsqueeze_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_252", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_319" + }, + { + "tensor": "mul_320" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_41", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_251" + }, + { + "tensor": "slice_207" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_42", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_252" + }, + { + "tensor": "slice_209" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_10", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_46" + }, + { + "tensor": "cat_42" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_11", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_47" + }, + { + "tensor": "transpose_94" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_44", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_10" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_11", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_44" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_39", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_11" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_16", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_39" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_45", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_11" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_12", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_45" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_40", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_12" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_17", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_40" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_95", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_16" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_11", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_41" + }, + { + "tensor": "transpose_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_321", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_11" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_253", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_321" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_5", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_253" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_12", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_5" + }, + { + "tensor": "_unsafe_view_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_96", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_12" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_41", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_96" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_155", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_41" + }, + [ + 1, + 4, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_23", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_322", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_155" + }, + { + "tensor": "sigmoid_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_182", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_322" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_254", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_244" + }, + { + "tensor": "linear_182" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_78", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_254" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_77", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_78" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_255", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_77" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_113", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_255" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_323", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_254" + }, + { + "tensor": "rsqrt_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_256", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_324", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_323" + }, + { + "tensor": "add_256" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_59", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_324" + }, + { + "tensor": "add_254" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_183", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_59" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_59", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_183" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_184", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_59" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_325", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_59" + }, + { + "tensor": "linear_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_185", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_325" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_257", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_254" + }, + { + "tensor": "linear_185" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_79", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_257" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_78", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_79" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_258", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_78" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_114", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_258" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_326", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_257" + }, + { + "tensor": "rsqrt_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_259", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_327", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_326" + }, + { + "tensor": "add_259" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_60", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_327" + }, + { + "tensor": "add_257" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "alias", + "op": "aten.alias.default", + "args": [ + { + "tensor": "type_as_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1787, in forward\n logits = self.lm_head(hidden_states[:, slice_indices, :])\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_186", + "op": "aten.linear.default", + "args": [ + { + "tensor": "alias" + }, + { + "tensor": "p_model_model_language_model_embed_tokens_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1787, in forward\n logits = self.lm_head(hidden_states[:, slice_indices, :])\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + } + ], + "quantization": [], + "states": [ + { + "input": "states_0", + "output": "slice_10", + "kind": "convolution" + }, + { + "input": "states_1", + "output": "slice_16", + "kind": "recurrent" + }, + { + "input": "states_2", + "output": "slice_18", + "kind": "convolution" + }, + { + "input": "states_3", + "output": "slice_24", + "kind": "recurrent" + }, + { + "input": "states_4", + "output": "slice_26", + "kind": "convolution" + }, + { + "input": "states_5", + "output": "slice_32", + "kind": "recurrent" + }, + { + "input": "states_6", + "output": "cache_update", + "kind": "kv" + }, + { + "input": "states_7", + "output": "cache_update_1", + "kind": "kv" + }, + { + "input": "states_8", + "output": "slice_44", + "kind": "convolution" + }, + { + "input": "states_9", + "output": "slice_50", + "kind": "recurrent" + }, + { + "input": "states_10", + "output": "slice_52", + "kind": "convolution" + }, + { + "input": "states_11", + "output": "slice_58", + "kind": "recurrent" + }, + { + "input": "states_12", + "output": "slice_60", + "kind": "convolution" + }, + { + "input": "states_13", + "output": "slice_66", + "kind": "recurrent" + }, + { + "input": "states_14", + "output": "cache_update_2", + "kind": "kv" + }, + { + "input": "states_15", + "output": "cache_update_3", + "kind": "kv" + }, + { + "input": "states_16", + "output": "slice_78", + "kind": "convolution" + }, + { + "input": "states_17", + "output": "slice_84", + "kind": "recurrent" + }, + { + "input": "states_18", + "output": "slice_86", + "kind": "convolution" + }, + { + "input": "states_19", + "output": "slice_92", + "kind": "recurrent" + }, + { + "input": "states_20", + "output": "slice_94", + "kind": "convolution" + }, + { + "input": "states_21", + "output": "slice_100", + "kind": "recurrent" + }, + { + "input": "states_22", + "output": "cache_update_4", + "kind": "kv" + }, + { + "input": "states_23", + "output": "cache_update_5", + "kind": "kv" + }, + { + "input": "states_24", + "output": "slice_112", + "kind": "convolution" + }, + { + "input": "states_25", + "output": "slice_118", + "kind": "recurrent" + }, + { + "input": "states_26", + "output": "slice_120", + "kind": "convolution" + }, + { + "input": "states_27", + "output": "slice_126", + "kind": "recurrent" + }, + { + "input": "states_28", + "output": "slice_128", + "kind": "convolution" + }, + { + "input": "states_29", + "output": "slice_134", + "kind": "recurrent" + }, + { + "input": "states_30", + "output": "cache_update_6", + "kind": "kv" + }, + { + "input": "states_31", + "output": "cache_update_7", + "kind": "kv" + }, + { + "input": "states_32", + "output": "slice_146", + "kind": "convolution" + }, + { + "input": "states_33", + "output": "slice_152", + "kind": "recurrent" + }, + { + "input": "states_34", + "output": "slice_154", + "kind": "convolution" + }, + { + "input": "states_35", + "output": "slice_160", + "kind": "recurrent" + }, + { + "input": "states_36", + "output": "slice_162", + "kind": "convolution" + }, + { + "input": "states_37", + "output": "slice_168", + "kind": "recurrent" + }, + { + "input": "states_38", + "output": "cache_update_8", + "kind": "kv" + }, + { + "input": "states_39", + "output": "cache_update_9", + "kind": "kv" + }, + { + "input": "states_40", + "output": "slice_180", + "kind": "convolution" + }, + { + "input": "states_41", + "output": "slice_186", + "kind": "recurrent" + }, + { + "input": "states_42", + "output": "slice_188", + "kind": "convolution" + }, + { + "input": "states_43", + "output": "slice_194", + "kind": "recurrent" + }, + { + "input": "states_44", + "output": "slice_196", + "kind": "convolution" + }, + { + "input": "states_45", + "output": "slice_202", + "kind": "recurrent" + }, + { + "input": "states_46", + "output": "cache_update_10", + "kind": "kv" + }, + { + "input": "states_47", + "output": "cache_update_11", + "kind": "kv" + } + ], + "dispatches": [ + { + "node": "embedding__part_0", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_0_32768" + ], + "output": "embedding__part_0", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/eb52355cc0ef7f698f9c4a5667eb20a31652d69cdab4e0f0774b81464b9528ca.wgsl" + }, + { + "node": "embedding__part_1", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768" + ], + "output": "embedding__part_1", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/6e158cae64ceafa60c5498129bbc4482684844432772c61a9f2cfb62482bdeb4.wgsl" + }, + { + "node": "embedding__part_2", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768" + ], + "output": "embedding__part_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/efacc40901cd20fbccdbd5fff0b0b52af2860746708640ae1907d6be212f5f86.wgsl" + }, + { + "node": "embedding__part_3", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768" + ], + "output": "embedding__part_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/687a9faf59b35be173c2861749834333b53400d1dd22bf430cef04722237a309.wgsl" + }, + { + "node": "embedding__part_4", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768" + ], + "output": "embedding__part_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/5ffab5e011b6e44aae54b4287fcbe68c4a20cee0779818a3178470f3b6d5ffd6.wgsl" + }, + { + "node": "embedding__part_5", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768" + ], + "output": "embedding__part_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/ff97954146b9a2a73ef2cfaa925f51254fc65b4eabcafb4ed57005054acd64b3.wgsl" + }, + { + "node": "embedding__part_6", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768" + ], + "output": "embedding__part_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/4365c6a2818dc6f2b29aa9a1994d3ff2a44af72e3e9276e92e927705e2bbea3e.wgsl" + }, + { + "node": "embedding__part_7", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944" + ], + "output": "embedding__part_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/eb77480d0d0529a45f6e0a1967f433c32b47ac7282ccc895f89d076949a71fbf.wgsl" + }, + { + "node": "embedding__sum_0", + "inputs": [ + "embedding__part_0", + "embedding__part_1" + ], + "output": "embedding__sum_0", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "embedding__sum_1", + "inputs": [ + "embedding__sum_0", + "embedding__part_2" + ], + "output": "embedding__sum_1", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "embedding__sum_2", + "inputs": [ + "embedding__sum_1", + "embedding__part_3" + ], + "output": "embedding__sum_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "embedding__sum_3", + "inputs": [ + "embedding__sum_2", + "embedding__part_4" + ], + "output": "embedding__sum_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "embedding__sum_4", + "inputs": [ + "embedding__sum_3", + "embedding__part_5" + ], + "output": "embedding__sum_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "embedding__sum_5", + "inputs": [ + "embedding__sum_4", + "embedding__part_6" + ], + "output": "embedding__sum_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "embedding", + "inputs": [ + "embedding__sum_5", + "embedding__part_7" + ], + "output": "embedding", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "where", + "inputs": [ + "embedding", + "image_embedding", + "is_image" + ], + "output": "where", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/66910ed3098ead5efda545ccf86d718ce7bb894c0d16e6944cdaed2c0f2a8b9f.wgsl" + }, + { + "node": "slice_1", + "inputs": [ + "position_ids" + ], + "output": "slice_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/11a92e9cba6bfc381c98c5127db137639d6c87f1cb220459880ead039dc81256.wgsl" + }, + { + "node": "unsqueeze", + "inputs": [ + "b_model_model_language_model_rotary_emb_inv_freq" + ], + "output": "unsqueeze", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "unsqueeze_1", + "inputs": [ + "unsqueeze" + ], + "output": "unsqueeze_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "unsqueeze_2", + "inputs": [ + "unsqueeze_1" + ], + "output": "unsqueeze_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "expand", + "inputs": [ + "unsqueeze_2" + ], + "output": "expand", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl" + }, + { + "node": "unsqueeze_3", + "inputs": [ + "slice_1" + ], + "output": "unsqueeze_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/82bc226410ee45662442e25040b6a6456c2532b87e96860e10f8f0135dde892b.wgsl" + }, + { + "node": "_to_copy", + "inputs": [ + "unsqueeze_3" + ], + "output": "_to_copy", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/a2bd65fc2709e093644d6cbf0c292b4d71520009a87bedcf4bca8fcb5f5c15b8.wgsl" + }, + { + "node": "matmul", + "inputs": [ + "expand", + "_to_copy" + ], + "output": "matmul", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/a87152b0fd2f78f60d7abb61c2f6c4a9bde8a9dd45d0275b58d760a3da9f71ce.wgsl" + }, + { + "node": "transpose", + "inputs": [ + "matmul" + ], + "output": "transpose", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl" + }, + { + "node": "select", + "inputs": [ + "transpose" + ], + "output": "select", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl" + }, + { + "node": "select_1", + "inputs": [ + "transpose" + ], + "output": "select_1", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/8cce7bfa491959f6a7b62ae9cb861d12e2f4ff05227918a4d06bd80669f0a539.wgsl" + }, + { + "node": "slice_2", + "inputs": [ + "select_1" + ], + "output": "slice_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb.wgsl" + }, + { + "node": "slice_3", + "inputs": [ + "select" + ], + "output": "slice_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb.wgsl" + }, + { + "node": "copy", + "inputs": [ + "slice_2" + ], + "output": "copy", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/0725908abf78c022f86deb338a06779f6f1346ebfe54ff5a43ee6b9eeb93c972.wgsl" + }, + { + "node": "transpose_1", + "inputs": [ + "matmul" + ], + "output": "transpose_1", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl" + }, + { + "node": "select_2", + "inputs": [ + "transpose_1" + ], + "output": "select_2", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl" + }, + { + "node": "slice_scatter", + "inputs": [ + "copy", + "select_2" + ], + "output": "slice_scatter", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/1545025e0a625ccc73b42ae112c6f9d78a1504c10b759979ae2247984f25f056.wgsl" + }, + { + "node": "select_scatter", + "inputs": [ + "slice_scatter", + "transpose_1" + ], + "output": "select_scatter", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/3f89d19bd6791657fa702ad00a0517b5f292dbf7d0c196bd5b21c949476d23fd.wgsl" + }, + { + "node": "transpose_2", + "inputs": [ + "select_scatter" + ], + "output": "transpose_2", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/2cd4a533d32097a17641196f0cd315d170c587bc2b1c62b42b79d566d6fbf140.wgsl" + }, + { + "node": "transpose_7", + "inputs": [ + "transpose_2" + ], + "output": "transpose_7", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl" + }, + { + "node": "select_7", + "inputs": [ + "transpose_7" + ], + "output": "select_7", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl" + }, + { + "node": "slice_7", + "inputs": [ + "select_7" + ], + "output": "slice_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3.wgsl" + }, + { + "node": "transpose_8", + "inputs": [ + "transpose_2" + ], + "output": "transpose_8", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl" + }, + { + "node": "select_8", + "inputs": [ + "transpose_8" + ], + "output": "select_8", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/62f30a62c18ed78c9bf37bdc56529accbee2264b9eac931ba0b35a80bb917e7c.wgsl" + }, + { + "node": "slice_8", + "inputs": [ + "select_8" + ], + "output": "slice_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/752da00e33abf87b63eba03893a16e7db848f97f1385942d40d8cfb5122d9bd3.wgsl" + }, + { + "node": "copy_1", + "inputs": [ + "slice_8" + ], + "output": "copy_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/7928d1b13d79c16f6c0f9d3130cbdb4193cab6efe3a60b38caa1039688fe56de.wgsl" + }, + { + "node": "transpose_9", + "inputs": [ + "transpose_2" + ], + "output": "transpose_9", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl" + }, + { + "node": "select_9", + "inputs": [ + "transpose_9" + ], + "output": "select_9", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl" + }, + { + "node": "slice_scatter_1", + "inputs": [ + "copy_1", + "select_9" + ], + "output": "slice_scatter_1", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/ae69e698c92571766e36ad8c078b13e42bde56745d45698daaadaca587b7279c.wgsl" + }, + { + "node": "select_scatter_1", + "inputs": [ + "slice_scatter_1", + "transpose_9" + ], + "output": "select_scatter_1", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/3f89d19bd6791657fa702ad00a0517b5f292dbf7d0c196bd5b21c949476d23fd.wgsl" + }, + { + "node": "transpose_10", + "inputs": [ + "select_scatter_1" + ], + "output": "transpose_10", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/2cd4a533d32097a17641196f0cd315d170c587bc2b1c62b42b79d566d6fbf140.wgsl" + }, + { + "node": "transpose_12", + "inputs": [ + "transpose_10" + ], + "output": "transpose_12", + "workgroups": [ + 6, + 1, + 1 + ], + "kernel": "kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl" + }, + { + "node": "select_11", + "inputs": [ + "transpose_12" + ], + "output": "select_11", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/95cba13b595301afbefe20da4a65b93d4d5c5f4a29b9e1d5348d32cb193c6b4b.wgsl" + }, + { + "node": "cat", + "inputs": [ + "select_11" + ], + "output": "cat", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/0d3892883d1532d173a7dbe85d9ab1daa87f0d9b4923a535b8d2003f24f9500c.wgsl" + }, + { + "node": "cos", + "inputs": [ + "cat" + ], + "output": "cos", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/d8c79a22e83e4a3b75b732bffa9ca673713bb57d580c5af4e59c805645ff1ca3.wgsl" + }, + { + "node": "mul", + "inputs": [ + "cos" + ], + "output": "mul", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d.wgsl" + }, + { + "node": "sin", + "inputs": [ + "cat" + ], + "output": "sin", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/0b8815b1efe176d55ab08530c0a9e1913cf6c9ef3e773c574843573d237cf196.wgsl" + }, + { + "node": "mul_1", + "inputs": [ + "sin" + ], + "output": "mul_1", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/e84c817e08236e486418f6b0b81f5abd27756f82be67cfbc15736410ac3c7e5d.wgsl" + }, + { + "node": "mul_3", + "inputs": [ + "where", + "p_model_model_language_model_layers_0_input_layernorm_weight" + ], + "output": "mul_3", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as", + "inputs": [ + "mul_3" + ], + "output": "type_as", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight" + ], + "output": "linear", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_13", + "inputs": [ + "linear" + ], + "output": "transpose_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_1", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight" + ], + "output": "linear_1", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view", + "inputs": [ + "linear_1" + ], + "output": "view", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_2", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight" + ], + "output": "linear_2", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_3", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight" + ], + "output": "linear_3", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_1", + "inputs": [ + "states_0", + "transpose_13" + ], + "output": "cat_1", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_10", + "inputs": [ + "cat_1" + ], + "output": "slice_10", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_0", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze", + "inputs": [ + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight" + ], + "output": "squeeze", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_4", + "inputs": [ + "squeeze" + ], + "output": "unsqueeze_4", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d", + "inputs": [ + "cat_1", + "unsqueeze_4" + ], + "output": "conv1d", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_11", + "inputs": [ + "conv1d" + ], + "output": "slice_11", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu", + "inputs": [ + "slice_11" + ], + "output": "silu", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_12", + "inputs": [ + "silu" + ], + "output": "slice_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_14", + "inputs": [ + "slice_12" + ], + "output": "transpose_14", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_13", + "inputs": [ + "transpose_14" + ], + "output": "slice_13", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_14", + "inputs": [ + "transpose_14" + ], + "output": "slice_14", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_15", + "inputs": [ + "transpose_14" + ], + "output": "slice_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_1", + "inputs": [ + "slice_13" + ], + "output": "view_1", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_2", + "inputs": [ + "slice_14" + ], + "output": "view_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_3", + "inputs": [ + "slice_15" + ], + "output": "view_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid", + "inputs": [ + "linear_2" + ], + "output": "sigmoid", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp", + "inputs": [ + "p_model_model_language_model_layers_0_linear_attn_a_log" + ], + "output": "exp", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg", + "inputs": [ + "exp" + ], + "output": "neg", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_2", + "inputs": [ + "linear_3", + "p_model_model_language_model_layers_0_linear_attn_dt_bias" + ], + "output": "add_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus", + "inputs": [ + "add_2" + ], + "output": "softplus", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_4", + "inputs": [ + "neg", + "softplus" + ], + "output": "mul_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_5", + "inputs": [ + "view_1" + ], + "output": "mul_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_1", + "inputs": [ + "mul_5" + ], + "output": "sum_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_3", + "inputs": [ + "sum_1" + ], + "output": "add_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_1", + "inputs": [ + "add_3" + ], + "output": "rsqrt_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_6", + "inputs": [ + "view_1", + "rsqrt_1" + ], + "output": "mul_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_7", + "inputs": [ + "view_2" + ], + "output": "mul_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_2", + "inputs": [ + "mul_7" + ], + "output": "sum_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_4", + "inputs": [ + "sum_2" + ], + "output": "add_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_2", + "inputs": [ + "add_4" + ], + "output": "rsqrt_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_8", + "inputs": [ + "view_2", + "rsqrt_2" + ], + "output": "mul_8", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule", + "inputs": [ + "mul_6", + "mul_8", + "view_3", + "mul_4", + "sigmoid", + "states_1" + ], + "output": "normalized_gated_delta_rule", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_16", + "inputs": [ + "normalized_gated_delta_rule" + ], + "output": "slice_16", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_1", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_17", + "inputs": [ + "normalized_gated_delta_rule" + ], + "output": "slice_17", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_15", + "inputs": [ + "slice_17" + ], + "output": "transpose_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone", + "inputs": [ + "transpose_15" + ], + "output": "clone", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_4", + "inputs": [ + "clone" + ], + "output": "view_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_5", + "inputs": [ + "view" + ], + "output": "view_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_10", + "inputs": [ + "view_4", + "p_model_model_language_model_layers_0_linear_attn_norm_weight" + ], + "output": "mul_10", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_11", + "inputs": [ + "view_5", + "mul_10" + ], + "output": "mul_11", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_6", + "inputs": [ + "mul_11" + ], + "output": "view_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_4", + "inputs": [ + "view_6", + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight" + ], + "output": "linear_4", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_6", + "inputs": [ + "where", + "linear_4" + ], + "output": "add_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_13", + "inputs": [ + "add_6", + "p_model_model_language_model_layers_0_post_attention_layernorm_weight" + ], + "output": "mul_13", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_1", + "inputs": [ + "mul_13" + ], + "output": "type_as_1", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_5", + "inputs": [ + "type_as_1", + "p_model_model_language_model_layers_0_mlp_gate_proj_weight" + ], + "output": "linear_5", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_6", + "inputs": [ + "type_as_1", + "p_model_model_language_model_layers_0_mlp_up_proj_weight" + ], + "output": "linear_6", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_14", + "inputs": [ + "linear_5", + "linear_6" + ], + "output": "mul_14", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_7", + "inputs": [ + "mul_14", + "p_model_model_language_model_layers_0_mlp_down_proj_weight" + ], + "output": "linear_7", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_9", + "inputs": [ + "add_6", + "linear_7" + ], + "output": "add_9", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_16", + "inputs": [ + "add_9", + "p_model_model_language_model_layers_1_input_layernorm_weight" + ], + "output": "mul_16", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_2", + "inputs": [ + "mul_16" + ], + "output": "type_as_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_8", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_8", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_16", + "inputs": [ + "linear_8" + ], + "output": "transpose_16", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_9", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight" + ], + "output": "linear_9", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_7", + "inputs": [ + "linear_9" + ], + "output": "view_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_10", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight" + ], + "output": "linear_10", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_11", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight" + ], + "output": "linear_11", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_2", + "inputs": [ + "states_2", + "transpose_16" + ], + "output": "cat_2", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_18", + "inputs": [ + "cat_2" + ], + "output": "slice_18", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_2", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_1", + "inputs": [ + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight" + ], + "output": "squeeze_1", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_5", + "inputs": [ + "squeeze_1" + ], + "output": "unsqueeze_5", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_1", + "inputs": [ + "cat_2", + "unsqueeze_5" + ], + "output": "conv1d_1", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_19", + "inputs": [ + "conv1d_1" + ], + "output": "slice_19", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_3", + "inputs": [ + "slice_19" + ], + "output": "silu_3", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_20", + "inputs": [ + "silu_3" + ], + "output": "slice_20", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_17", + "inputs": [ + "slice_20" + ], + "output": "transpose_17", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_21", + "inputs": [ + "transpose_17" + ], + "output": "slice_21", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_22", + "inputs": [ + "transpose_17" + ], + "output": "slice_22", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_23", + "inputs": [ + "transpose_17" + ], + "output": "slice_23", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_8", + "inputs": [ + "slice_21" + ], + "output": "view_8", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_9", + "inputs": [ + "slice_22" + ], + "output": "view_9", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_10", + "inputs": [ + "slice_23" + ], + "output": "view_10", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_1", + "inputs": [ + "linear_10" + ], + "output": "sigmoid_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_1", + "inputs": [ + "p_model_model_language_model_layers_1_linear_attn_a_log" + ], + "output": "exp_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_1", + "inputs": [ + "exp_1" + ], + "output": "neg_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_12", + "inputs": [ + "linear_11", + "p_model_model_language_model_layers_1_linear_attn_dt_bias" + ], + "output": "add_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_1", + "inputs": [ + "add_12" + ], + "output": "softplus_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_17", + "inputs": [ + "neg_1", + "softplus_1" + ], + "output": "mul_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_18", + "inputs": [ + "view_8" + ], + "output": "mul_18", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_3", + "inputs": [ + "mul_18" + ], + "output": "sum_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_13", + "inputs": [ + "sum_3" + ], + "output": "add_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_6", + "inputs": [ + "add_13" + ], + "output": "rsqrt_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_19", + "inputs": [ + "view_8", + "rsqrt_6" + ], + "output": "mul_19", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_20", + "inputs": [ + "view_9" + ], + "output": "mul_20", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_4", + "inputs": [ + "mul_20" + ], + "output": "sum_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_14", + "inputs": [ + "sum_4" + ], + "output": "add_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_7", + "inputs": [ + "add_14" + ], + "output": "rsqrt_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_21", + "inputs": [ + "view_9", + "rsqrt_7" + ], + "output": "mul_21", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_1", + "inputs": [ + "mul_19", + "mul_21", + "view_10", + "mul_17", + "sigmoid_1", + "states_3" + ], + "output": "normalized_gated_delta_rule_1", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_24", + "inputs": [ + "normalized_gated_delta_rule_1" + ], + "output": "slice_24", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_3", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_25", + "inputs": [ + "normalized_gated_delta_rule_1" + ], + "output": "slice_25", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_18", + "inputs": [ + "slice_25" + ], + "output": "transpose_18", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_1", + "inputs": [ + "transpose_18" + ], + "output": "clone_1", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_11", + "inputs": [ + "clone_1" + ], + "output": "view_11", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_12", + "inputs": [ + "view_7" + ], + "output": "view_12", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_23", + "inputs": [ + "view_11", + "p_model_model_language_model_layers_1_linear_attn_norm_weight" + ], + "output": "mul_23", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_24", + "inputs": [ + "view_12", + "mul_23" + ], + "output": "mul_24", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_13", + "inputs": [ + "mul_24" + ], + "output": "view_13", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_12", + "inputs": [ + "view_13", + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight" + ], + "output": "linear_12", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_16", + "inputs": [ + "add_9", + "linear_12" + ], + "output": "add_16", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_26", + "inputs": [ + "add_16", + "p_model_model_language_model_layers_1_post_attention_layernorm_weight" + ], + "output": "mul_26", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_3", + "inputs": [ + "mul_26" + ], + "output": "type_as_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_13", + "inputs": [ + "type_as_3", + "p_model_model_language_model_layers_1_mlp_gate_proj_weight" + ], + "output": "linear_13", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_14", + "inputs": [ + "type_as_3", + "p_model_model_language_model_layers_1_mlp_up_proj_weight" + ], + "output": "linear_14", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_27", + "inputs": [ + "linear_13", + "linear_14" + ], + "output": "mul_27", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_15", + "inputs": [ + "mul_27", + "p_model_model_language_model_layers_1_mlp_down_proj_weight" + ], + "output": "linear_15", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_19", + "inputs": [ + "add_16", + "linear_15" + ], + "output": "add_19", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_29", + "inputs": [ + "add_19", + "p_model_model_language_model_layers_2_input_layernorm_weight" + ], + "output": "mul_29", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_4", + "inputs": [ + "mul_29" + ], + "output": "type_as_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_16", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_16", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_19", + "inputs": [ + "linear_16" + ], + "output": "transpose_19", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_17", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight" + ], + "output": "linear_17", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_14", + "inputs": [ + "linear_17" + ], + "output": "view_14", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_18", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight" + ], + "output": "linear_18", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_19", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight" + ], + "output": "linear_19", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_3", + "inputs": [ + "states_4", + "transpose_19" + ], + "output": "cat_3", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_26", + "inputs": [ + "cat_3" + ], + "output": "slice_26", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_4", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_2", + "inputs": [ + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight" + ], + "output": "squeeze_2", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_6", + "inputs": [ + "squeeze_2" + ], + "output": "unsqueeze_6", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_2", + "inputs": [ + "cat_3", + "unsqueeze_6" + ], + "output": "conv1d_2", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_27", + "inputs": [ + "conv1d_2" + ], + "output": "slice_27", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_6", + "inputs": [ + "slice_27" + ], + "output": "silu_6", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_28", + "inputs": [ + "silu_6" + ], + "output": "slice_28", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_20", + "inputs": [ + "slice_28" + ], + "output": "transpose_20", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_29", + "inputs": [ + "transpose_20" + ], + "output": "slice_29", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_30", + "inputs": [ + "transpose_20" + ], + "output": "slice_30", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_31", + "inputs": [ + "transpose_20" + ], + "output": "slice_31", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_15", + "inputs": [ + "slice_29" + ], + "output": "view_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_16", + "inputs": [ + "slice_30" + ], + "output": "view_16", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_17", + "inputs": [ + "slice_31" + ], + "output": "view_17", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_2", + "inputs": [ + "linear_18" + ], + "output": "sigmoid_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_2", + "inputs": [ + "p_model_model_language_model_layers_2_linear_attn_a_log" + ], + "output": "exp_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_2", + "inputs": [ + "exp_2" + ], + "output": "neg_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_22", + "inputs": [ + "linear_19", + "p_model_model_language_model_layers_2_linear_attn_dt_bias" + ], + "output": "add_22", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_2", + "inputs": [ + "add_22" + ], + "output": "softplus_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_30", + "inputs": [ + "neg_2", + "softplus_2" + ], + "output": "mul_30", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_31", + "inputs": [ + "view_15" + ], + "output": "mul_31", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_5", + "inputs": [ + "mul_31" + ], + "output": "sum_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_23", + "inputs": [ + "sum_5" + ], + "output": "add_23", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_11", + "inputs": [ + "add_23" + ], + "output": "rsqrt_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_32", + "inputs": [ + "view_15", + "rsqrt_11" + ], + "output": "mul_32", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_33", + "inputs": [ + "view_16" + ], + "output": "mul_33", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_6", + "inputs": [ + "mul_33" + ], + "output": "sum_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_24", + "inputs": [ + "sum_6" + ], + "output": "add_24", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_12", + "inputs": [ + "add_24" + ], + "output": "rsqrt_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_34", + "inputs": [ + "view_16", + "rsqrt_12" + ], + "output": "mul_34", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_2", + "inputs": [ + "mul_32", + "mul_34", + "view_17", + "mul_30", + "sigmoid_2", + "states_5" + ], + "output": "normalized_gated_delta_rule_2", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_32", + "inputs": [ + "normalized_gated_delta_rule_2" + ], + "output": "slice_32", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_5", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_33", + "inputs": [ + "normalized_gated_delta_rule_2" + ], + "output": "slice_33", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_21", + "inputs": [ + "slice_33" + ], + "output": "transpose_21", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_2", + "inputs": [ + "transpose_21" + ], + "output": "clone_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_18", + "inputs": [ + "clone_2" + ], + "output": "view_18", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_19", + "inputs": [ + "view_14" + ], + "output": "view_19", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_36", + "inputs": [ + "view_18", + "p_model_model_language_model_layers_2_linear_attn_norm_weight" + ], + "output": "mul_36", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_37", + "inputs": [ + "view_19", + "mul_36" + ], + "output": "mul_37", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_20", + "inputs": [ + "mul_37" + ], + "output": "view_20", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_20", + "inputs": [ + "view_20", + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight" + ], + "output": "linear_20", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_26", + "inputs": [ + "add_19", + "linear_20" + ], + "output": "add_26", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_39", + "inputs": [ + "add_26", + "p_model_model_language_model_layers_2_post_attention_layernorm_weight" + ], + "output": "mul_39", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_5", + "inputs": [ + "mul_39" + ], + "output": "type_as_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_21", + "inputs": [ + "type_as_5", + "p_model_model_language_model_layers_2_mlp_gate_proj_weight" + ], + "output": "linear_21", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_22", + "inputs": [ + "type_as_5", + "p_model_model_language_model_layers_2_mlp_up_proj_weight" + ], + "output": "linear_22", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_40", + "inputs": [ + "linear_21", + "linear_22" + ], + "output": "mul_40", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_23", + "inputs": [ + "mul_40", + "p_model_model_language_model_layers_2_mlp_down_proj_weight" + ], + "output": "linear_23", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_29", + "inputs": [ + "add_26", + "linear_23" + ], + "output": "add_29", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_42", + "inputs": [ + "add_29", + "p_model_model_language_model_layers_3_input_layernorm_weight" + ], + "output": "mul_42", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_6", + "inputs": [ + "mul_42" + ], + "output": "type_as_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_24", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_q_proj_weight" + ], + "output": "linear_24", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/809edbbbbbd45df1163aca9506775b9c2ae0d51f65a31a5396599cfeeb7009fc.wgsl" + }, + { + "node": "view_21", + "inputs": [ + "linear_24" + ], + "output": "view_21", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl" + }, + { + "node": "slice_34", + "inputs": [ + "view_21" + ], + "output": "slice_34", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl" + }, + { + "node": "slice_35", + "inputs": [ + "view_21" + ], + "output": "slice_35", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl" + }, + { + "node": "clone_3", + "inputs": [ + "slice_35" + ], + "output": "clone_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "_unsafe_view", + "inputs": [ + "clone_3" + ], + "output": "_unsafe_view", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_22", + "inputs": [ + "slice_34" + ], + "output": "view_22", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_44", + "inputs": [ + "view_22", + "p_model_model_language_model_layers_3_self_attn_q_norm_weight" + ], + "output": "mul_44", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_7", + "inputs": [ + "mul_44" + ], + "output": "type_as_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_22", + "inputs": [ + "type_as_7" + ], + "output": "transpose_22", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl" + }, + { + "node": "linear_25", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_k_proj_weight" + ], + "output": "linear_25", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_23", + "inputs": [ + "linear_25" + ], + "output": "view_23", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "mul_46", + "inputs": [ + "view_23", + "p_model_model_language_model_layers_3_self_attn_k_norm_weight" + ], + "output": "mul_46", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl" + }, + { + "node": "type_as_8", + "inputs": [ + "mul_46" + ], + "output": "type_as_8", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_23", + "inputs": [ + "type_as_8" + ], + "output": "transpose_23", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "linear_26", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_v_proj_weight" + ], + "output": "linear_26", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_24", + "inputs": [ + "linear_26" + ], + "output": "view_24", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_24", + "inputs": [ + "view_24" + ], + "output": "transpose_24", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "unsqueeze_7", + "inputs": [ + "mul" + ], + "output": "unsqueeze_7", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "unsqueeze_8", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_8", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "slice_36", + "inputs": [ + "transpose_22" + ], + "output": "slice_36", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl" + }, + { + "node": "slice_37", + "inputs": [ + "transpose_22" + ], + "output": "slice_37", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl" + }, + { + "node": "slice_38", + "inputs": [ + "transpose_23" + ], + "output": "slice_38", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl" + }, + { + "node": "slice_39", + "inputs": [ + "transpose_23" + ], + "output": "slice_39", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl" + }, + { + "node": "mul_47", + "inputs": [ + "slice_36", + "unsqueeze_7" + ], + "output": "mul_47", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "slice_40", + "inputs": [ + "slice_36" + ], + "output": "slice_40", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl" + }, + { + "node": "slice_41", + "inputs": [ + "slice_36" + ], + "output": "slice_41", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl" + }, + { + "node": "neg_3", + "inputs": [ + "slice_41" + ], + "output": "neg_3", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_4", + "inputs": [ + "neg_3", + "slice_40" + ], + "output": "cat_4", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_48", + "inputs": [ + "cat_4", + "unsqueeze_8" + ], + "output": "mul_48", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "add_36", + "inputs": [ + "mul_47", + "mul_48" + ], + "output": "add_36", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "mul_49", + "inputs": [ + "slice_38", + "unsqueeze_7" + ], + "output": "mul_49", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "slice_42", + "inputs": [ + "slice_38" + ], + "output": "slice_42", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl" + }, + { + "node": "slice_43", + "inputs": [ + "slice_38" + ], + "output": "slice_43", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl" + }, + { + "node": "neg_4", + "inputs": [ + "slice_43" + ], + "output": "neg_4", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl" + }, + { + "node": "cat_5", + "inputs": [ + "neg_4", + "slice_42" + ], + "output": "cat_5", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl" + }, + { + "node": "mul_50", + "inputs": [ + "cat_5", + "unsqueeze_8" + ], + "output": "mul_50", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "add_37", + "inputs": [ + "mul_49", + "mul_50" + ], + "output": "add_37", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl" + }, + { + "node": "cat_6", + "inputs": [ + "add_36", + "slice_37" + ], + "output": "cat_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cat_7", + "inputs": [ + "add_37", + "slice_39" + ], + "output": "cat_7", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl" + }, + { + "node": "cache_update", + "inputs": [ + "cat_7", + "cache_position" + ], + "output": "cache_update", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_6", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "cache_update_1", + "inputs": [ + "transpose_24", + "cache_position" + ], + "output": "cache_update_1", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_7", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "unsqueeze_9", + "inputs": [ + "cache_update" + ], + "output": "unsqueeze_9", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_1", + "inputs": [ + "unsqueeze_9" + ], + "output": "expand_1", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_4", + "inputs": [ + "expand_1" + ], + "output": "clone_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_1", + "inputs": [ + "clone_4" + ], + "output": "_unsafe_view_1", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_10", + "inputs": [ + "cache_update_1" + ], + "output": "unsqueeze_10", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_2", + "inputs": [ + "unsqueeze_10" + ], + "output": "expand_2", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_5", + "inputs": [ + "expand_2" + ], + "output": "clone_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_2", + "inputs": [ + "clone_5" + ], + "output": "_unsafe_view_2", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_25", + "inputs": [ + "_unsafe_view_1" + ], + "output": "transpose_25", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_1", + "inputs": [ + "cat_6", + "transpose_25" + ], + "output": "matmul_1", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl" + }, + { + "node": "mul_51", + "inputs": [ + "matmul_1" + ], + "output": "mul_51", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl" + }, + { + "node": "add_38", + "inputs": [ + "mul_51", + "attention_mask" + ], + "output": "add_38", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl" + }, + { + "node": "softmax", + "inputs": [ + "add_38" + ], + "output": "softmax", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl" + }, + { + "node": "matmul_2", + "inputs": [ + "softmax", + "_unsafe_view_2" + ], + "output": "matmul_2", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl" + }, + { + "node": "transpose_26", + "inputs": [ + "matmul_2" + ], + "output": "transpose_26", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl" + }, + { + "node": "clone_6", + "inputs": [ + "transpose_26" + ], + "output": "clone_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_25", + "inputs": [ + "clone_6" + ], + "output": "view_25", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_3", + "inputs": [ + "_unsafe_view" + ], + "output": "sigmoid_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl" + }, + { + "node": "mul_52", + "inputs": [ + "view_25", + "sigmoid_3" + ], + "output": "mul_52", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl" + }, + { + "node": "linear_27", + "inputs": [ + "mul_52", + "p_model_model_language_model_layers_3_self_attn_o_proj_weight" + ], + "output": "linear_27", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_39", + "inputs": [ + "add_29", + "linear_27" + ], + "output": "add_39", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_54", + "inputs": [ + "add_39", + "p_model_model_language_model_layers_3_post_attention_layernorm_weight" + ], + "output": "mul_54", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_9", + "inputs": [ + "mul_54" + ], + "output": "type_as_9", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_28", + "inputs": [ + "type_as_9", + "p_model_model_language_model_layers_3_mlp_gate_proj_weight" + ], + "output": "linear_28", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_29", + "inputs": [ + "type_as_9", + "p_model_model_language_model_layers_3_mlp_up_proj_weight" + ], + "output": "linear_29", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_55", + "inputs": [ + "linear_28", + "linear_29" + ], + "output": "mul_55", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_30", + "inputs": [ + "mul_55", + "p_model_model_language_model_layers_3_mlp_down_proj_weight" + ], + "output": "linear_30", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_42", + "inputs": [ + "add_39", + "linear_30" + ], + "output": "add_42", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_57", + "inputs": [ + "add_42", + "p_model_model_language_model_layers_4_input_layernorm_weight" + ], + "output": "mul_57", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_10", + "inputs": [ + "mul_57" + ], + "output": "type_as_10", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_31", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_31", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_27", + "inputs": [ + "linear_31" + ], + "output": "transpose_27", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_32", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight" + ], + "output": "linear_32", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_26", + "inputs": [ + "linear_32" + ], + "output": "view_26", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_33", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight" + ], + "output": "linear_33", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_34", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight" + ], + "output": "linear_34", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_8", + "inputs": [ + "states_8", + "transpose_27" + ], + "output": "cat_8", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_44", + "inputs": [ + "cat_8" + ], + "output": "slice_44", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_8", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_3", + "inputs": [ + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight" + ], + "output": "squeeze_3", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_11", + "inputs": [ + "squeeze_3" + ], + "output": "unsqueeze_11", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_3", + "inputs": [ + "cat_8", + "unsqueeze_11" + ], + "output": "conv1d_3", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_45", + "inputs": [ + "conv1d_3" + ], + "output": "slice_45", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_10", + "inputs": [ + "slice_45" + ], + "output": "silu_10", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_46", + "inputs": [ + "silu_10" + ], + "output": "slice_46", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_28", + "inputs": [ + "slice_46" + ], + "output": "transpose_28", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_47", + "inputs": [ + "transpose_28" + ], + "output": "slice_47", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_48", + "inputs": [ + "transpose_28" + ], + "output": "slice_48", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_49", + "inputs": [ + "transpose_28" + ], + "output": "slice_49", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_27", + "inputs": [ + "slice_47" + ], + "output": "view_27", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_28", + "inputs": [ + "slice_48" + ], + "output": "view_28", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_29", + "inputs": [ + "slice_49" + ], + "output": "view_29", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_4", + "inputs": [ + "linear_33" + ], + "output": "sigmoid_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_3", + "inputs": [ + "p_model_model_language_model_layers_4_linear_attn_a_log" + ], + "output": "exp_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_5", + "inputs": [ + "exp_3" + ], + "output": "neg_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_45", + "inputs": [ + "linear_34", + "p_model_model_language_model_layers_4_linear_attn_dt_bias" + ], + "output": "add_45", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_3", + "inputs": [ + "add_45" + ], + "output": "softplus_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_58", + "inputs": [ + "neg_5", + "softplus_3" + ], + "output": "mul_58", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_59", + "inputs": [ + "view_27" + ], + "output": "mul_59", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_7", + "inputs": [ + "mul_59" + ], + "output": "sum_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_46", + "inputs": [ + "sum_7" + ], + "output": "add_46", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_20", + "inputs": [ + "add_46" + ], + "output": "rsqrt_20", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_60", + "inputs": [ + "view_27", + "rsqrt_20" + ], + "output": "mul_60", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_61", + "inputs": [ + "view_28" + ], + "output": "mul_61", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_8", + "inputs": [ + "mul_61" + ], + "output": "sum_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_47", + "inputs": [ + "sum_8" + ], + "output": "add_47", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_21", + "inputs": [ + "add_47" + ], + "output": "rsqrt_21", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_62", + "inputs": [ + "view_28", + "rsqrt_21" + ], + "output": "mul_62", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_3", + "inputs": [ + "mul_60", + "mul_62", + "view_29", + "mul_58", + "sigmoid_4", + "states_9" + ], + "output": "normalized_gated_delta_rule_3", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_50", + "inputs": [ + "normalized_gated_delta_rule_3" + ], + "output": "slice_50", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_9", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_51", + "inputs": [ + "normalized_gated_delta_rule_3" + ], + "output": "slice_51", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_29", + "inputs": [ + "slice_51" + ], + "output": "transpose_29", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_7", + "inputs": [ + "transpose_29" + ], + "output": "clone_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_30", + "inputs": [ + "clone_7" + ], + "output": "view_30", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_31", + "inputs": [ + "view_26" + ], + "output": "view_31", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_64", + "inputs": [ + "view_30", + "p_model_model_language_model_layers_4_linear_attn_norm_weight" + ], + "output": "mul_64", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_65", + "inputs": [ + "view_31", + "mul_64" + ], + "output": "mul_65", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_32", + "inputs": [ + "mul_65" + ], + "output": "view_32", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_35", + "inputs": [ + "view_32", + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight" + ], + "output": "linear_35", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_49", + "inputs": [ + "add_42", + "linear_35" + ], + "output": "add_49", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_67", + "inputs": [ + "add_49", + "p_model_model_language_model_layers_4_post_attention_layernorm_weight" + ], + "output": "mul_67", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_11", + "inputs": [ + "mul_67" + ], + "output": "type_as_11", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_36", + "inputs": [ + "type_as_11", + "p_model_model_language_model_layers_4_mlp_gate_proj_weight" + ], + "output": "linear_36", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_37", + "inputs": [ + "type_as_11", + "p_model_model_language_model_layers_4_mlp_up_proj_weight" + ], + "output": "linear_37", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_68", + "inputs": [ + "linear_36", + "linear_37" + ], + "output": "mul_68", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_38", + "inputs": [ + "mul_68", + "p_model_model_language_model_layers_4_mlp_down_proj_weight" + ], + "output": "linear_38", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_52", + "inputs": [ + "add_49", + "linear_38" + ], + "output": "add_52", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_70", + "inputs": [ + "add_52", + "p_model_model_language_model_layers_5_input_layernorm_weight" + ], + "output": "mul_70", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_12", + "inputs": [ + "mul_70" + ], + "output": "type_as_12", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_39", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_39", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_30", + "inputs": [ + "linear_39" + ], + "output": "transpose_30", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_40", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight" + ], + "output": "linear_40", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_33", + "inputs": [ + "linear_40" + ], + "output": "view_33", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_41", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight" + ], + "output": "linear_41", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_42", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight" + ], + "output": "linear_42", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_9", + "inputs": [ + "states_10", + "transpose_30" + ], + "output": "cat_9", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_52", + "inputs": [ + "cat_9" + ], + "output": "slice_52", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_10", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_4", + "inputs": [ + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight" + ], + "output": "squeeze_4", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_12", + "inputs": [ + "squeeze_4" + ], + "output": "unsqueeze_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_4", + "inputs": [ + "cat_9", + "unsqueeze_12" + ], + "output": "conv1d_4", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_53", + "inputs": [ + "conv1d_4" + ], + "output": "slice_53", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_13", + "inputs": [ + "slice_53" + ], + "output": "silu_13", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_54", + "inputs": [ + "silu_13" + ], + "output": "slice_54", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_31", + "inputs": [ + "slice_54" + ], + "output": "transpose_31", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_55", + "inputs": [ + "transpose_31" + ], + "output": "slice_55", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_56", + "inputs": [ + "transpose_31" + ], + "output": "slice_56", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_57", + "inputs": [ + "transpose_31" + ], + "output": "slice_57", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_34", + "inputs": [ + "slice_55" + ], + "output": "view_34", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_35", + "inputs": [ + "slice_56" + ], + "output": "view_35", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_36", + "inputs": [ + "slice_57" + ], + "output": "view_36", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_5", + "inputs": [ + "linear_41" + ], + "output": "sigmoid_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_4", + "inputs": [ + "p_model_model_language_model_layers_5_linear_attn_a_log" + ], + "output": "exp_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_6", + "inputs": [ + "exp_4" + ], + "output": "neg_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_55", + "inputs": [ + "linear_42", + "p_model_model_language_model_layers_5_linear_attn_dt_bias" + ], + "output": "add_55", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_4", + "inputs": [ + "add_55" + ], + "output": "softplus_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_71", + "inputs": [ + "neg_6", + "softplus_4" + ], + "output": "mul_71", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_72", + "inputs": [ + "view_34" + ], + "output": "mul_72", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_9", + "inputs": [ + "mul_72" + ], + "output": "sum_9", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_56", + "inputs": [ + "sum_9" + ], + "output": "add_56", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_25", + "inputs": [ + "add_56" + ], + "output": "rsqrt_25", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_73", + "inputs": [ + "view_34", + "rsqrt_25" + ], + "output": "mul_73", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_74", + "inputs": [ + "view_35" + ], + "output": "mul_74", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_10", + "inputs": [ + "mul_74" + ], + "output": "sum_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_57", + "inputs": [ + "sum_10" + ], + "output": "add_57", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_26", + "inputs": [ + "add_57" + ], + "output": "rsqrt_26", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_75", + "inputs": [ + "view_35", + "rsqrt_26" + ], + "output": "mul_75", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_4", + "inputs": [ + "mul_73", + "mul_75", + "view_36", + "mul_71", + "sigmoid_5", + "states_11" + ], + "output": "normalized_gated_delta_rule_4", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_58", + "inputs": [ + "normalized_gated_delta_rule_4" + ], + "output": "slice_58", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_11", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_59", + "inputs": [ + "normalized_gated_delta_rule_4" + ], + "output": "slice_59", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_32", + "inputs": [ + "slice_59" + ], + "output": "transpose_32", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_8", + "inputs": [ + "transpose_32" + ], + "output": "clone_8", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_37", + "inputs": [ + "clone_8" + ], + "output": "view_37", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_38", + "inputs": [ + "view_33" + ], + "output": "view_38", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_77", + "inputs": [ + "view_37", + "p_model_model_language_model_layers_5_linear_attn_norm_weight" + ], + "output": "mul_77", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_78", + "inputs": [ + "view_38", + "mul_77" + ], + "output": "mul_78", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_39", + "inputs": [ + "mul_78" + ], + "output": "view_39", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_43", + "inputs": [ + "view_39", + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight" + ], + "output": "linear_43", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_59", + "inputs": [ + "add_52", + "linear_43" + ], + "output": "add_59", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_80", + "inputs": [ + "add_59", + "p_model_model_language_model_layers_5_post_attention_layernorm_weight" + ], + "output": "mul_80", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_13", + "inputs": [ + "mul_80" + ], + "output": "type_as_13", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_44", + "inputs": [ + "type_as_13", + "p_model_model_language_model_layers_5_mlp_gate_proj_weight" + ], + "output": "linear_44", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_45", + "inputs": [ + "type_as_13", + "p_model_model_language_model_layers_5_mlp_up_proj_weight" + ], + "output": "linear_45", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_81", + "inputs": [ + "linear_44", + "linear_45" + ], + "output": "mul_81", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_46", + "inputs": [ + "mul_81", + "p_model_model_language_model_layers_5_mlp_down_proj_weight" + ], + "output": "linear_46", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_62", + "inputs": [ + "add_59", + "linear_46" + ], + "output": "add_62", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_83", + "inputs": [ + "add_62", + "p_model_model_language_model_layers_6_input_layernorm_weight" + ], + "output": "mul_83", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_14", + "inputs": [ + "mul_83" + ], + "output": "type_as_14", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_47", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_47", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_33", + "inputs": [ + "linear_47" + ], + "output": "transpose_33", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_48", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight" + ], + "output": "linear_48", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_40", + "inputs": [ + "linear_48" + ], + "output": "view_40", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_49", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight" + ], + "output": "linear_49", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_50", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight" + ], + "output": "linear_50", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_10", + "inputs": [ + "states_12", + "transpose_33" + ], + "output": "cat_10", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_60", + "inputs": [ + "cat_10" + ], + "output": "slice_60", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_12", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_5", + "inputs": [ + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight" + ], + "output": "squeeze_5", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_13", + "inputs": [ + "squeeze_5" + ], + "output": "unsqueeze_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_5", + "inputs": [ + "cat_10", + "unsqueeze_13" + ], + "output": "conv1d_5", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_61", + "inputs": [ + "conv1d_5" + ], + "output": "slice_61", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_16", + "inputs": [ + "slice_61" + ], + "output": "silu_16", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_62", + "inputs": [ + "silu_16" + ], + "output": "slice_62", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_34", + "inputs": [ + "slice_62" + ], + "output": "transpose_34", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_63", + "inputs": [ + "transpose_34" + ], + "output": "slice_63", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_64", + "inputs": [ + "transpose_34" + ], + "output": "slice_64", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_65", + "inputs": [ + "transpose_34" + ], + "output": "slice_65", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_41", + "inputs": [ + "slice_63" + ], + "output": "view_41", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_42", + "inputs": [ + "slice_64" + ], + "output": "view_42", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_43", + "inputs": [ + "slice_65" + ], + "output": "view_43", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_6", + "inputs": [ + "linear_49" + ], + "output": "sigmoid_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_5", + "inputs": [ + "p_model_model_language_model_layers_6_linear_attn_a_log" + ], + "output": "exp_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_7", + "inputs": [ + "exp_5" + ], + "output": "neg_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_65", + "inputs": [ + "linear_50", + "p_model_model_language_model_layers_6_linear_attn_dt_bias" + ], + "output": "add_65", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_5", + "inputs": [ + "add_65" + ], + "output": "softplus_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_84", + "inputs": [ + "neg_7", + "softplus_5" + ], + "output": "mul_84", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_85", + "inputs": [ + "view_41" + ], + "output": "mul_85", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_11", + "inputs": [ + "mul_85" + ], + "output": "sum_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_66", + "inputs": [ + "sum_11" + ], + "output": "add_66", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_30", + "inputs": [ + "add_66" + ], + "output": "rsqrt_30", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_86", + "inputs": [ + "view_41", + "rsqrt_30" + ], + "output": "mul_86", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_87", + "inputs": [ + "view_42" + ], + "output": "mul_87", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_12", + "inputs": [ + "mul_87" + ], + "output": "sum_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_67", + "inputs": [ + "sum_12" + ], + "output": "add_67", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_31", + "inputs": [ + "add_67" + ], + "output": "rsqrt_31", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_88", + "inputs": [ + "view_42", + "rsqrt_31" + ], + "output": "mul_88", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_5", + "inputs": [ + "mul_86", + "mul_88", + "view_43", + "mul_84", + "sigmoid_6", + "states_13" + ], + "output": "normalized_gated_delta_rule_5", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_66", + "inputs": [ + "normalized_gated_delta_rule_5" + ], + "output": "slice_66", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_13", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_67", + "inputs": [ + "normalized_gated_delta_rule_5" + ], + "output": "slice_67", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_35", + "inputs": [ + "slice_67" + ], + "output": "transpose_35", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_9", + "inputs": [ + "transpose_35" + ], + "output": "clone_9", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_44", + "inputs": [ + "clone_9" + ], + "output": "view_44", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_45", + "inputs": [ + "view_40" + ], + "output": "view_45", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_90", + "inputs": [ + "view_44", + "p_model_model_language_model_layers_6_linear_attn_norm_weight" + ], + "output": "mul_90", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_91", + "inputs": [ + "view_45", + "mul_90" + ], + "output": "mul_91", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_46", + "inputs": [ + "mul_91" + ], + "output": "view_46", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_51", + "inputs": [ + "view_46", + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight" + ], + "output": "linear_51", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_69", + "inputs": [ + "add_62", + "linear_51" + ], + "output": "add_69", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_93", + "inputs": [ + "add_69", + "p_model_model_language_model_layers_6_post_attention_layernorm_weight" + ], + "output": "mul_93", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_15", + "inputs": [ + "mul_93" + ], + "output": "type_as_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_52", + "inputs": [ + "type_as_15", + "p_model_model_language_model_layers_6_mlp_gate_proj_weight" + ], + "output": "linear_52", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_53", + "inputs": [ + "type_as_15", + "p_model_model_language_model_layers_6_mlp_up_proj_weight" + ], + "output": "linear_53", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_94", + "inputs": [ + "linear_52", + "linear_53" + ], + "output": "mul_94", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_54", + "inputs": [ + "mul_94", + "p_model_model_language_model_layers_6_mlp_down_proj_weight" + ], + "output": "linear_54", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_72", + "inputs": [ + "add_69", + "linear_54" + ], + "output": "add_72", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_96", + "inputs": [ + "add_72", + "p_model_model_language_model_layers_7_input_layernorm_weight" + ], + "output": "mul_96", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_16", + "inputs": [ + "mul_96" + ], + "output": "type_as_16", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_55", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_q_proj_weight" + ], + "output": "linear_55", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/809edbbbbbd45df1163aca9506775b9c2ae0d51f65a31a5396599cfeeb7009fc.wgsl" + }, + { + "node": "view_47", + "inputs": [ + "linear_55" + ], + "output": "view_47", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl" + }, + { + "node": "slice_68", + "inputs": [ + "view_47" + ], + "output": "slice_68", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl" + }, + { + "node": "slice_69", + "inputs": [ + "view_47" + ], + "output": "slice_69", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl" + }, + { + "node": "clone_10", + "inputs": [ + "slice_69" + ], + "output": "clone_10", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "_unsafe_view_3", + "inputs": [ + "clone_10" + ], + "output": "_unsafe_view_3", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_48", + "inputs": [ + "slice_68" + ], + "output": "view_48", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_98", + "inputs": [ + "view_48", + "p_model_model_language_model_layers_7_self_attn_q_norm_weight" + ], + "output": "mul_98", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_17", + "inputs": [ + "mul_98" + ], + "output": "type_as_17", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_36", + "inputs": [ + "type_as_17" + ], + "output": "transpose_36", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl" + }, + { + "node": "linear_56", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_k_proj_weight" + ], + "output": "linear_56", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_49", + "inputs": [ + "linear_56" + ], + "output": "view_49", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "mul_100", + "inputs": [ + "view_49", + "p_model_model_language_model_layers_7_self_attn_k_norm_weight" + ], + "output": "mul_100", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl" + }, + { + "node": "type_as_18", + "inputs": [ + "mul_100" + ], + "output": "type_as_18", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_37", + "inputs": [ + "type_as_18" + ], + "output": "transpose_37", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "linear_57", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_v_proj_weight" + ], + "output": "linear_57", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_50", + "inputs": [ + "linear_57" + ], + "output": "view_50", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_38", + "inputs": [ + "view_50" + ], + "output": "transpose_38", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "unsqueeze_14", + "inputs": [ + "mul" + ], + "output": "unsqueeze_14", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "unsqueeze_15", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_15", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "slice_70", + "inputs": [ + "transpose_36" + ], + "output": "slice_70", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl" + }, + { + "node": "slice_71", + "inputs": [ + "transpose_36" + ], + "output": "slice_71", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl" + }, + { + "node": "slice_72", + "inputs": [ + "transpose_37" + ], + "output": "slice_72", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl" + }, + { + "node": "slice_73", + "inputs": [ + "transpose_37" + ], + "output": "slice_73", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl" + }, + { + "node": "mul_101", + "inputs": [ + "slice_70", + "unsqueeze_14" + ], + "output": "mul_101", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "slice_74", + "inputs": [ + "slice_70" + ], + "output": "slice_74", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl" + }, + { + "node": "slice_75", + "inputs": [ + "slice_70" + ], + "output": "slice_75", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl" + }, + { + "node": "neg_8", + "inputs": [ + "slice_75" + ], + "output": "neg_8", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_11", + "inputs": [ + "neg_8", + "slice_74" + ], + "output": "cat_11", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_102", + "inputs": [ + "cat_11", + "unsqueeze_15" + ], + "output": "mul_102", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "add_79", + "inputs": [ + "mul_101", + "mul_102" + ], + "output": "add_79", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "mul_103", + "inputs": [ + "slice_72", + "unsqueeze_14" + ], + "output": "mul_103", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "slice_76", + "inputs": [ + "slice_72" + ], + "output": "slice_76", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl" + }, + { + "node": "slice_77", + "inputs": [ + "slice_72" + ], + "output": "slice_77", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl" + }, + { + "node": "neg_9", + "inputs": [ + "slice_77" + ], + "output": "neg_9", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl" + }, + { + "node": "cat_12", + "inputs": [ + "neg_9", + "slice_76" + ], + "output": "cat_12", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl" + }, + { + "node": "mul_104", + "inputs": [ + "cat_12", + "unsqueeze_15" + ], + "output": "mul_104", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "add_80", + "inputs": [ + "mul_103", + "mul_104" + ], + "output": "add_80", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl" + }, + { + "node": "cat_13", + "inputs": [ + "add_79", + "slice_71" + ], + "output": "cat_13", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cat_14", + "inputs": [ + "add_80", + "slice_73" + ], + "output": "cat_14", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl" + }, + { + "node": "cache_update_2", + "inputs": [ + "cat_14", + "cache_position" + ], + "output": "cache_update_2", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_14", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "cache_update_3", + "inputs": [ + "transpose_38", + "cache_position" + ], + "output": "cache_update_3", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_15", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "unsqueeze_16", + "inputs": [ + "cache_update_2" + ], + "output": "unsqueeze_16", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_3", + "inputs": [ + "unsqueeze_16" + ], + "output": "expand_3", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_11", + "inputs": [ + "expand_3" + ], + "output": "clone_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_4", + "inputs": [ + "clone_11" + ], + "output": "_unsafe_view_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_17", + "inputs": [ + "cache_update_3" + ], + "output": "unsqueeze_17", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_4", + "inputs": [ + "unsqueeze_17" + ], + "output": "expand_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_12", + "inputs": [ + "expand_4" + ], + "output": "clone_12", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_5", + "inputs": [ + "clone_12" + ], + "output": "_unsafe_view_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_39", + "inputs": [ + "_unsafe_view_4" + ], + "output": "transpose_39", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_3", + "inputs": [ + "cat_13", + "transpose_39" + ], + "output": "matmul_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl" + }, + { + "node": "mul_105", + "inputs": [ + "matmul_3" + ], + "output": "mul_105", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl" + }, + { + "node": "add_81", + "inputs": [ + "mul_105", + "attention_mask" + ], + "output": "add_81", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl" + }, + { + "node": "softmax_1", + "inputs": [ + "add_81" + ], + "output": "softmax_1", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl" + }, + { + "node": "matmul_4", + "inputs": [ + "softmax_1", + "_unsafe_view_5" + ], + "output": "matmul_4", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl" + }, + { + "node": "transpose_40", + "inputs": [ + "matmul_4" + ], + "output": "transpose_40", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl" + }, + { + "node": "clone_13", + "inputs": [ + "transpose_40" + ], + "output": "clone_13", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_51", + "inputs": [ + "clone_13" + ], + "output": "view_51", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_7", + "inputs": [ + "_unsafe_view_3" + ], + "output": "sigmoid_7", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl" + }, + { + "node": "mul_106", + "inputs": [ + "view_51", + "sigmoid_7" + ], + "output": "mul_106", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl" + }, + { + "node": "linear_58", + "inputs": [ + "mul_106", + "p_model_model_language_model_layers_7_self_attn_o_proj_weight" + ], + "output": "linear_58", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_82", + "inputs": [ + "add_72", + "linear_58" + ], + "output": "add_82", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_108", + "inputs": [ + "add_82", + "p_model_model_language_model_layers_7_post_attention_layernorm_weight" + ], + "output": "mul_108", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_19", + "inputs": [ + "mul_108" + ], + "output": "type_as_19", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_59", + "inputs": [ + "type_as_19", + "p_model_model_language_model_layers_7_mlp_gate_proj_weight" + ], + "output": "linear_59", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_60", + "inputs": [ + "type_as_19", + "p_model_model_language_model_layers_7_mlp_up_proj_weight" + ], + "output": "linear_60", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_109", + "inputs": [ + "linear_59", + "linear_60" + ], + "output": "mul_109", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_61", + "inputs": [ + "mul_109", + "p_model_model_language_model_layers_7_mlp_down_proj_weight" + ], + "output": "linear_61", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_85", + "inputs": [ + "add_82", + "linear_61" + ], + "output": "add_85", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_111", + "inputs": [ + "add_85", + "p_model_model_language_model_layers_8_input_layernorm_weight" + ], + "output": "mul_111", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_20", + "inputs": [ + "mul_111" + ], + "output": "type_as_20", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_62", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_62", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_41", + "inputs": [ + "linear_62" + ], + "output": "transpose_41", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_63", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight" + ], + "output": "linear_63", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_52", + "inputs": [ + "linear_63" + ], + "output": "view_52", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_64", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight" + ], + "output": "linear_64", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_65", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight" + ], + "output": "linear_65", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_15", + "inputs": [ + "states_16", + "transpose_41" + ], + "output": "cat_15", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_78", + "inputs": [ + "cat_15" + ], + "output": "slice_78", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_16", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_6", + "inputs": [ + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight" + ], + "output": "squeeze_6", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_18", + "inputs": [ + "squeeze_6" + ], + "output": "unsqueeze_18", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_6", + "inputs": [ + "cat_15", + "unsqueeze_18" + ], + "output": "conv1d_6", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_79", + "inputs": [ + "conv1d_6" + ], + "output": "slice_79", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_20", + "inputs": [ + "slice_79" + ], + "output": "silu_20", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_80", + "inputs": [ + "silu_20" + ], + "output": "slice_80", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_42", + "inputs": [ + "slice_80" + ], + "output": "transpose_42", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_81", + "inputs": [ + "transpose_42" + ], + "output": "slice_81", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_82", + "inputs": [ + "transpose_42" + ], + "output": "slice_82", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_83", + "inputs": [ + "transpose_42" + ], + "output": "slice_83", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_53", + "inputs": [ + "slice_81" + ], + "output": "view_53", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_54", + "inputs": [ + "slice_82" + ], + "output": "view_54", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_55", + "inputs": [ + "slice_83" + ], + "output": "view_55", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_8", + "inputs": [ + "linear_64" + ], + "output": "sigmoid_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_6", + "inputs": [ + "p_model_model_language_model_layers_8_linear_attn_a_log" + ], + "output": "exp_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_10", + "inputs": [ + "exp_6" + ], + "output": "neg_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_88", + "inputs": [ + "linear_65", + "p_model_model_language_model_layers_8_linear_attn_dt_bias" + ], + "output": "add_88", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_6", + "inputs": [ + "add_88" + ], + "output": "softplus_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_112", + "inputs": [ + "neg_10", + "softplus_6" + ], + "output": "mul_112", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_113", + "inputs": [ + "view_53" + ], + "output": "mul_113", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_13", + "inputs": [ + "mul_113" + ], + "output": "sum_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_89", + "inputs": [ + "sum_13" + ], + "output": "add_89", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_39", + "inputs": [ + "add_89" + ], + "output": "rsqrt_39", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_114", + "inputs": [ + "view_53", + "rsqrt_39" + ], + "output": "mul_114", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_115", + "inputs": [ + "view_54" + ], + "output": "mul_115", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_14", + "inputs": [ + "mul_115" + ], + "output": "sum_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_90", + "inputs": [ + "sum_14" + ], + "output": "add_90", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_40", + "inputs": [ + "add_90" + ], + "output": "rsqrt_40", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_116", + "inputs": [ + "view_54", + "rsqrt_40" + ], + "output": "mul_116", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_6", + "inputs": [ + "mul_114", + "mul_116", + "view_55", + "mul_112", + "sigmoid_8", + "states_17" + ], + "output": "normalized_gated_delta_rule_6", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_84", + "inputs": [ + "normalized_gated_delta_rule_6" + ], + "output": "slice_84", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_17", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_85", + "inputs": [ + "normalized_gated_delta_rule_6" + ], + "output": "slice_85", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_43", + "inputs": [ + "slice_85" + ], + "output": "transpose_43", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_14", + "inputs": [ + "transpose_43" + ], + "output": "clone_14", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_56", + "inputs": [ + "clone_14" + ], + "output": "view_56", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_57", + "inputs": [ + "view_52" + ], + "output": "view_57", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_118", + "inputs": [ + "view_56", + "p_model_model_language_model_layers_8_linear_attn_norm_weight" + ], + "output": "mul_118", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_119", + "inputs": [ + "view_57", + "mul_118" + ], + "output": "mul_119", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_58", + "inputs": [ + "mul_119" + ], + "output": "view_58", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_66", + "inputs": [ + "view_58", + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight" + ], + "output": "linear_66", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_92", + "inputs": [ + "add_85", + "linear_66" + ], + "output": "add_92", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_121", + "inputs": [ + "add_92", + "p_model_model_language_model_layers_8_post_attention_layernorm_weight" + ], + "output": "mul_121", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_21", + "inputs": [ + "mul_121" + ], + "output": "type_as_21", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_67", + "inputs": [ + "type_as_21", + "p_model_model_language_model_layers_8_mlp_gate_proj_weight" + ], + "output": "linear_67", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_68", + "inputs": [ + "type_as_21", + "p_model_model_language_model_layers_8_mlp_up_proj_weight" + ], + "output": "linear_68", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_122", + "inputs": [ + "linear_67", + "linear_68" + ], + "output": "mul_122", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_69", + "inputs": [ + "mul_122", + "p_model_model_language_model_layers_8_mlp_down_proj_weight" + ], + "output": "linear_69", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_95", + "inputs": [ + "add_92", + "linear_69" + ], + "output": "add_95", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_124", + "inputs": [ + "add_95", + "p_model_model_language_model_layers_9_input_layernorm_weight" + ], + "output": "mul_124", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_22", + "inputs": [ + "mul_124" + ], + "output": "type_as_22", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_70", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_70", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_44", + "inputs": [ + "linear_70" + ], + "output": "transpose_44", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_71", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight" + ], + "output": "linear_71", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_59", + "inputs": [ + "linear_71" + ], + "output": "view_59", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_72", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight" + ], + "output": "linear_72", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_73", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight" + ], + "output": "linear_73", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_16", + "inputs": [ + "states_18", + "transpose_44" + ], + "output": "cat_16", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_86", + "inputs": [ + "cat_16" + ], + "output": "slice_86", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_18", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_7", + "inputs": [ + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight" + ], + "output": "squeeze_7", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_19", + "inputs": [ + "squeeze_7" + ], + "output": "unsqueeze_19", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_7", + "inputs": [ + "cat_16", + "unsqueeze_19" + ], + "output": "conv1d_7", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_87", + "inputs": [ + "conv1d_7" + ], + "output": "slice_87", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_23", + "inputs": [ + "slice_87" + ], + "output": "silu_23", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_88", + "inputs": [ + "silu_23" + ], + "output": "slice_88", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_45", + "inputs": [ + "slice_88" + ], + "output": "transpose_45", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_89", + "inputs": [ + "transpose_45" + ], + "output": "slice_89", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_90", + "inputs": [ + "transpose_45" + ], + "output": "slice_90", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_91", + "inputs": [ + "transpose_45" + ], + "output": "slice_91", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_60", + "inputs": [ + "slice_89" + ], + "output": "view_60", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_61", + "inputs": [ + "slice_90" + ], + "output": "view_61", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_62", + "inputs": [ + "slice_91" + ], + "output": "view_62", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_9", + "inputs": [ + "linear_72" + ], + "output": "sigmoid_9", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_7", + "inputs": [ + "p_model_model_language_model_layers_9_linear_attn_a_log" + ], + "output": "exp_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_11", + "inputs": [ + "exp_7" + ], + "output": "neg_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_98", + "inputs": [ + "linear_73", + "p_model_model_language_model_layers_9_linear_attn_dt_bias" + ], + "output": "add_98", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_7", + "inputs": [ + "add_98" + ], + "output": "softplus_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_125", + "inputs": [ + "neg_11", + "softplus_7" + ], + "output": "mul_125", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_126", + "inputs": [ + "view_60" + ], + "output": "mul_126", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_15", + "inputs": [ + "mul_126" + ], + "output": "sum_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_99", + "inputs": [ + "sum_15" + ], + "output": "add_99", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_44", + "inputs": [ + "add_99" + ], + "output": "rsqrt_44", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_127", + "inputs": [ + "view_60", + "rsqrt_44" + ], + "output": "mul_127", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_128", + "inputs": [ + "view_61" + ], + "output": "mul_128", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_16", + "inputs": [ + "mul_128" + ], + "output": "sum_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_100", + "inputs": [ + "sum_16" + ], + "output": "add_100", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_45", + "inputs": [ + "add_100" + ], + "output": "rsqrt_45", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_129", + "inputs": [ + "view_61", + "rsqrt_45" + ], + "output": "mul_129", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_7", + "inputs": [ + "mul_127", + "mul_129", + "view_62", + "mul_125", + "sigmoid_9", + "states_19" + ], + "output": "normalized_gated_delta_rule_7", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_92", + "inputs": [ + "normalized_gated_delta_rule_7" + ], + "output": "slice_92", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_19", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_93", + "inputs": [ + "normalized_gated_delta_rule_7" + ], + "output": "slice_93", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_46", + "inputs": [ + "slice_93" + ], + "output": "transpose_46", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_15", + "inputs": [ + "transpose_46" + ], + "output": "clone_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_63", + "inputs": [ + "clone_15" + ], + "output": "view_63", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_64", + "inputs": [ + "view_59" + ], + "output": "view_64", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_131", + "inputs": [ + "view_63", + "p_model_model_language_model_layers_9_linear_attn_norm_weight" + ], + "output": "mul_131", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_132", + "inputs": [ + "view_64", + "mul_131" + ], + "output": "mul_132", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_65", + "inputs": [ + "mul_132" + ], + "output": "view_65", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_74", + "inputs": [ + "view_65", + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight" + ], + "output": "linear_74", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_102", + "inputs": [ + "add_95", + "linear_74" + ], + "output": "add_102", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_134", + "inputs": [ + "add_102", + "p_model_model_language_model_layers_9_post_attention_layernorm_weight" + ], + "output": "mul_134", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_23", + "inputs": [ + "mul_134" + ], + "output": "type_as_23", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_75", + "inputs": [ + "type_as_23", + "p_model_model_language_model_layers_9_mlp_gate_proj_weight" + ], + "output": "linear_75", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_76", + "inputs": [ + "type_as_23", + "p_model_model_language_model_layers_9_mlp_up_proj_weight" + ], + "output": "linear_76", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_135", + "inputs": [ + "linear_75", + "linear_76" + ], + "output": "mul_135", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_77", + "inputs": [ + "mul_135", + "p_model_model_language_model_layers_9_mlp_down_proj_weight" + ], + "output": "linear_77", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_105", + "inputs": [ + "add_102", + "linear_77" + ], + "output": "add_105", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_137", + "inputs": [ + "add_105", + "p_model_model_language_model_layers_10_input_layernorm_weight" + ], + "output": "mul_137", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_24", + "inputs": [ + "mul_137" + ], + "output": "type_as_24", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_78", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_78", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_47", + "inputs": [ + "linear_78" + ], + "output": "transpose_47", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_79", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight" + ], + "output": "linear_79", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_66", + "inputs": [ + "linear_79" + ], + "output": "view_66", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_80", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight" + ], + "output": "linear_80", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_81", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight" + ], + "output": "linear_81", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_17", + "inputs": [ + "states_20", + "transpose_47" + ], + "output": "cat_17", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_94", + "inputs": [ + "cat_17" + ], + "output": "slice_94", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_20", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_8", + "inputs": [ + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight" + ], + "output": "squeeze_8", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_20", + "inputs": [ + "squeeze_8" + ], + "output": "unsqueeze_20", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_8", + "inputs": [ + "cat_17", + "unsqueeze_20" + ], + "output": "conv1d_8", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_95", + "inputs": [ + "conv1d_8" + ], + "output": "slice_95", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_26", + "inputs": [ + "slice_95" + ], + "output": "silu_26", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_96", + "inputs": [ + "silu_26" + ], + "output": "slice_96", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_48", + "inputs": [ + "slice_96" + ], + "output": "transpose_48", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_97", + "inputs": [ + "transpose_48" + ], + "output": "slice_97", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_98", + "inputs": [ + "transpose_48" + ], + "output": "slice_98", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_99", + "inputs": [ + "transpose_48" + ], + "output": "slice_99", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_67", + "inputs": [ + "slice_97" + ], + "output": "view_67", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_68", + "inputs": [ + "slice_98" + ], + "output": "view_68", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_69", + "inputs": [ + "slice_99" + ], + "output": "view_69", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_10", + "inputs": [ + "linear_80" + ], + "output": "sigmoid_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_8", + "inputs": [ + "p_model_model_language_model_layers_10_linear_attn_a_log" + ], + "output": "exp_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_12", + "inputs": [ + "exp_8" + ], + "output": "neg_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_108", + "inputs": [ + "linear_81", + "p_model_model_language_model_layers_10_linear_attn_dt_bias" + ], + "output": "add_108", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_8", + "inputs": [ + "add_108" + ], + "output": "softplus_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_138", + "inputs": [ + "neg_12", + "softplus_8" + ], + "output": "mul_138", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_139", + "inputs": [ + "view_67" + ], + "output": "mul_139", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_17", + "inputs": [ + "mul_139" + ], + "output": "sum_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_109", + "inputs": [ + "sum_17" + ], + "output": "add_109", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_49", + "inputs": [ + "add_109" + ], + "output": "rsqrt_49", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_140", + "inputs": [ + "view_67", + "rsqrt_49" + ], + "output": "mul_140", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_141", + "inputs": [ + "view_68" + ], + "output": "mul_141", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_18", + "inputs": [ + "mul_141" + ], + "output": "sum_18", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_110", + "inputs": [ + "sum_18" + ], + "output": "add_110", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_50", + "inputs": [ + "add_110" + ], + "output": "rsqrt_50", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_142", + "inputs": [ + "view_68", + "rsqrt_50" + ], + "output": "mul_142", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_8", + "inputs": [ + "mul_140", + "mul_142", + "view_69", + "mul_138", + "sigmoid_10", + "states_21" + ], + "output": "normalized_gated_delta_rule_8", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_100", + "inputs": [ + "normalized_gated_delta_rule_8" + ], + "output": "slice_100", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_21", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_101", + "inputs": [ + "normalized_gated_delta_rule_8" + ], + "output": "slice_101", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_49", + "inputs": [ + "slice_101" + ], + "output": "transpose_49", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_16", + "inputs": [ + "transpose_49" + ], + "output": "clone_16", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_70", + "inputs": [ + "clone_16" + ], + "output": "view_70", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_71", + "inputs": [ + "view_66" + ], + "output": "view_71", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_144", + "inputs": [ + "view_70", + "p_model_model_language_model_layers_10_linear_attn_norm_weight" + ], + "output": "mul_144", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_145", + "inputs": [ + "view_71", + "mul_144" + ], + "output": "mul_145", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_72", + "inputs": [ + "mul_145" + ], + "output": "view_72", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_82", + "inputs": [ + "view_72", + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight" + ], + "output": "linear_82", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_112", + "inputs": [ + "add_105", + "linear_82" + ], + "output": "add_112", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_147", + "inputs": [ + "add_112", + "p_model_model_language_model_layers_10_post_attention_layernorm_weight" + ], + "output": "mul_147", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_25", + "inputs": [ + "mul_147" + ], + "output": "type_as_25", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_83", + "inputs": [ + "type_as_25", + "p_model_model_language_model_layers_10_mlp_gate_proj_weight" + ], + "output": "linear_83", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_84", + "inputs": [ + "type_as_25", + "p_model_model_language_model_layers_10_mlp_up_proj_weight" + ], + "output": "linear_84", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_148", + "inputs": [ + "linear_83", + "linear_84" + ], + "output": "mul_148", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_85", + "inputs": [ + "mul_148", + "p_model_model_language_model_layers_10_mlp_down_proj_weight" + ], + "output": "linear_85", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_115", + "inputs": [ + "add_112", + "linear_85" + ], + "output": "add_115", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_150", + "inputs": [ + "add_115", + "p_model_model_language_model_layers_11_input_layernorm_weight" + ], + "output": "mul_150", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_26", + "inputs": [ + "mul_150" + ], + "output": "type_as_26", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_86", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_q_proj_weight" + ], + "output": "linear_86", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/809edbbbbbd45df1163aca9506775b9c2ae0d51f65a31a5396599cfeeb7009fc.wgsl" + }, + { + "node": "view_73", + "inputs": [ + "linear_86" + ], + "output": "view_73", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl" + }, + { + "node": "slice_102", + "inputs": [ + "view_73" + ], + "output": "slice_102", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl" + }, + { + "node": "slice_103", + "inputs": [ + "view_73" + ], + "output": "slice_103", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl" + }, + { + "node": "clone_17", + "inputs": [ + "slice_103" + ], + "output": "clone_17", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "_unsafe_view_6", + "inputs": [ + "clone_17" + ], + "output": "_unsafe_view_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_74", + "inputs": [ + "slice_102" + ], + "output": "view_74", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_152", + "inputs": [ + "view_74", + "p_model_model_language_model_layers_11_self_attn_q_norm_weight" + ], + "output": "mul_152", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_27", + "inputs": [ + "mul_152" + ], + "output": "type_as_27", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_50", + "inputs": [ + "type_as_27" + ], + "output": "transpose_50", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl" + }, + { + "node": "linear_87", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_k_proj_weight" + ], + "output": "linear_87", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_75", + "inputs": [ + "linear_87" + ], + "output": "view_75", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "mul_154", + "inputs": [ + "view_75", + "p_model_model_language_model_layers_11_self_attn_k_norm_weight" + ], + "output": "mul_154", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl" + }, + { + "node": "type_as_28", + "inputs": [ + "mul_154" + ], + "output": "type_as_28", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_51", + "inputs": [ + "type_as_28" + ], + "output": "transpose_51", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "linear_88", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_v_proj_weight" + ], + "output": "linear_88", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_76", + "inputs": [ + "linear_88" + ], + "output": "view_76", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_52", + "inputs": [ + "view_76" + ], + "output": "transpose_52", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "unsqueeze_21", + "inputs": [ + "mul" + ], + "output": "unsqueeze_21", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "unsqueeze_22", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_22", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "slice_104", + "inputs": [ + "transpose_50" + ], + "output": "slice_104", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl" + }, + { + "node": "slice_105", + "inputs": [ + "transpose_50" + ], + "output": "slice_105", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl" + }, + { + "node": "slice_106", + "inputs": [ + "transpose_51" + ], + "output": "slice_106", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl" + }, + { + "node": "slice_107", + "inputs": [ + "transpose_51" + ], + "output": "slice_107", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl" + }, + { + "node": "mul_155", + "inputs": [ + "slice_104", + "unsqueeze_21" + ], + "output": "mul_155", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "slice_108", + "inputs": [ + "slice_104" + ], + "output": "slice_108", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl" + }, + { + "node": "slice_109", + "inputs": [ + "slice_104" + ], + "output": "slice_109", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl" + }, + { + "node": "neg_13", + "inputs": [ + "slice_109" + ], + "output": "neg_13", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_18", + "inputs": [ + "neg_13", + "slice_108" + ], + "output": "cat_18", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_156", + "inputs": [ + "cat_18", + "unsqueeze_22" + ], + "output": "mul_156", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "add_122", + "inputs": [ + "mul_155", + "mul_156" + ], + "output": "add_122", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "mul_157", + "inputs": [ + "slice_106", + "unsqueeze_21" + ], + "output": "mul_157", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "slice_110", + "inputs": [ + "slice_106" + ], + "output": "slice_110", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl" + }, + { + "node": "slice_111", + "inputs": [ + "slice_106" + ], + "output": "slice_111", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl" + }, + { + "node": "neg_14", + "inputs": [ + "slice_111" + ], + "output": "neg_14", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl" + }, + { + "node": "cat_19", + "inputs": [ + "neg_14", + "slice_110" + ], + "output": "cat_19", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl" + }, + { + "node": "mul_158", + "inputs": [ + "cat_19", + "unsqueeze_22" + ], + "output": "mul_158", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "add_123", + "inputs": [ + "mul_157", + "mul_158" + ], + "output": "add_123", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl" + }, + { + "node": "cat_20", + "inputs": [ + "add_122", + "slice_105" + ], + "output": "cat_20", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cat_21", + "inputs": [ + "add_123", + "slice_107" + ], + "output": "cat_21", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl" + }, + { + "node": "cache_update_4", + "inputs": [ + "cat_21", + "cache_position" + ], + "output": "cache_update_4", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_22", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "cache_update_5", + "inputs": [ + "transpose_52", + "cache_position" + ], + "output": "cache_update_5", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_23", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "unsqueeze_23", + "inputs": [ + "cache_update_4" + ], + "output": "unsqueeze_23", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_5", + "inputs": [ + "unsqueeze_23" + ], + "output": "expand_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_18", + "inputs": [ + "expand_5" + ], + "output": "clone_18", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_7", + "inputs": [ + "clone_18" + ], + "output": "_unsafe_view_7", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_24", + "inputs": [ + "cache_update_5" + ], + "output": "unsqueeze_24", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_6", + "inputs": [ + "unsqueeze_24" + ], + "output": "expand_6", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_19", + "inputs": [ + "expand_6" + ], + "output": "clone_19", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_8", + "inputs": [ + "clone_19" + ], + "output": "_unsafe_view_8", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_53", + "inputs": [ + "_unsafe_view_7" + ], + "output": "transpose_53", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_5", + "inputs": [ + "cat_20", + "transpose_53" + ], + "output": "matmul_5", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl" + }, + { + "node": "mul_159", + "inputs": [ + "matmul_5" + ], + "output": "mul_159", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl" + }, + { + "node": "add_124", + "inputs": [ + "mul_159", + "attention_mask" + ], + "output": "add_124", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl" + }, + { + "node": "softmax_2", + "inputs": [ + "add_124" + ], + "output": "softmax_2", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl" + }, + { + "node": "matmul_6", + "inputs": [ + "softmax_2", + "_unsafe_view_8" + ], + "output": "matmul_6", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl" + }, + { + "node": "transpose_54", + "inputs": [ + "matmul_6" + ], + "output": "transpose_54", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl" + }, + { + "node": "clone_20", + "inputs": [ + "transpose_54" + ], + "output": "clone_20", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_77", + "inputs": [ + "clone_20" + ], + "output": "view_77", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_11", + "inputs": [ + "_unsafe_view_6" + ], + "output": "sigmoid_11", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl" + }, + { + "node": "mul_160", + "inputs": [ + "view_77", + "sigmoid_11" + ], + "output": "mul_160", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl" + }, + { + "node": "linear_89", + "inputs": [ + "mul_160", + "p_model_model_language_model_layers_11_self_attn_o_proj_weight" + ], + "output": "linear_89", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_125", + "inputs": [ + "add_115", + "linear_89" + ], + "output": "add_125", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_162", + "inputs": [ + "add_125", + "p_model_model_language_model_layers_11_post_attention_layernorm_weight" + ], + "output": "mul_162", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_29", + "inputs": [ + "mul_162" + ], + "output": "type_as_29", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_90", + "inputs": [ + "type_as_29", + "p_model_model_language_model_layers_11_mlp_gate_proj_weight" + ], + "output": "linear_90", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_91", + "inputs": [ + "type_as_29", + "p_model_model_language_model_layers_11_mlp_up_proj_weight" + ], + "output": "linear_91", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_163", + "inputs": [ + "linear_90", + "linear_91" + ], + "output": "mul_163", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_92", + "inputs": [ + "mul_163", + "p_model_model_language_model_layers_11_mlp_down_proj_weight" + ], + "output": "linear_92", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_128", + "inputs": [ + "add_125", + "linear_92" + ], + "output": "add_128", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_165", + "inputs": [ + "add_128", + "p_model_model_language_model_layers_12_input_layernorm_weight" + ], + "output": "mul_165", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_30", + "inputs": [ + "mul_165" + ], + "output": "type_as_30", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_93", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_93", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_55", + "inputs": [ + "linear_93" + ], + "output": "transpose_55", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_94", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight" + ], + "output": "linear_94", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_78", + "inputs": [ + "linear_94" + ], + "output": "view_78", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_95", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight" + ], + "output": "linear_95", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_96", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight" + ], + "output": "linear_96", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_22", + "inputs": [ + "states_24", + "transpose_55" + ], + "output": "cat_22", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_112", + "inputs": [ + "cat_22" + ], + "output": "slice_112", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_24", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_9", + "inputs": [ + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight" + ], + "output": "squeeze_9", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_25", + "inputs": [ + "squeeze_9" + ], + "output": "unsqueeze_25", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_9", + "inputs": [ + "cat_22", + "unsqueeze_25" + ], + "output": "conv1d_9", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_113", + "inputs": [ + "conv1d_9" + ], + "output": "slice_113", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_30", + "inputs": [ + "slice_113" + ], + "output": "silu_30", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_114", + "inputs": [ + "silu_30" + ], + "output": "slice_114", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_56", + "inputs": [ + "slice_114" + ], + "output": "transpose_56", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_115", + "inputs": [ + "transpose_56" + ], + "output": "slice_115", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_116", + "inputs": [ + "transpose_56" + ], + "output": "slice_116", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_117", + "inputs": [ + "transpose_56" + ], + "output": "slice_117", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_79", + "inputs": [ + "slice_115" + ], + "output": "view_79", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_80", + "inputs": [ + "slice_116" + ], + "output": "view_80", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_81", + "inputs": [ + "slice_117" + ], + "output": "view_81", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_12", + "inputs": [ + "linear_95" + ], + "output": "sigmoid_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_9", + "inputs": [ + "p_model_model_language_model_layers_12_linear_attn_a_log" + ], + "output": "exp_9", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_15", + "inputs": [ + "exp_9" + ], + "output": "neg_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_131", + "inputs": [ + "linear_96", + "p_model_model_language_model_layers_12_linear_attn_dt_bias" + ], + "output": "add_131", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_9", + "inputs": [ + "add_131" + ], + "output": "softplus_9", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_166", + "inputs": [ + "neg_15", + "softplus_9" + ], + "output": "mul_166", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_167", + "inputs": [ + "view_79" + ], + "output": "mul_167", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_19", + "inputs": [ + "mul_167" + ], + "output": "sum_19", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_132", + "inputs": [ + "sum_19" + ], + "output": "add_132", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_58", + "inputs": [ + "add_132" + ], + "output": "rsqrt_58", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_168", + "inputs": [ + "view_79", + "rsqrt_58" + ], + "output": "mul_168", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_169", + "inputs": [ + "view_80" + ], + "output": "mul_169", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_20", + "inputs": [ + "mul_169" + ], + "output": "sum_20", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_133", + "inputs": [ + "sum_20" + ], + "output": "add_133", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_59", + "inputs": [ + "add_133" + ], + "output": "rsqrt_59", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_170", + "inputs": [ + "view_80", + "rsqrt_59" + ], + "output": "mul_170", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_9", + "inputs": [ + "mul_168", + "mul_170", + "view_81", + "mul_166", + "sigmoid_12", + "states_25" + ], + "output": "normalized_gated_delta_rule_9", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_118", + "inputs": [ + "normalized_gated_delta_rule_9" + ], + "output": "slice_118", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_25", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_119", + "inputs": [ + "normalized_gated_delta_rule_9" + ], + "output": "slice_119", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_57", + "inputs": [ + "slice_119" + ], + "output": "transpose_57", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_21", + "inputs": [ + "transpose_57" + ], + "output": "clone_21", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_82", + "inputs": [ + "clone_21" + ], + "output": "view_82", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_83", + "inputs": [ + "view_78" + ], + "output": "view_83", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_172", + "inputs": [ + "view_82", + "p_model_model_language_model_layers_12_linear_attn_norm_weight" + ], + "output": "mul_172", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_173", + "inputs": [ + "view_83", + "mul_172" + ], + "output": "mul_173", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_84", + "inputs": [ + "mul_173" + ], + "output": "view_84", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_97", + "inputs": [ + "view_84", + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight" + ], + "output": "linear_97", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_135", + "inputs": [ + "add_128", + "linear_97" + ], + "output": "add_135", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_175", + "inputs": [ + "add_135", + "p_model_model_language_model_layers_12_post_attention_layernorm_weight" + ], + "output": "mul_175", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_31", + "inputs": [ + "mul_175" + ], + "output": "type_as_31", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_98", + "inputs": [ + "type_as_31", + "p_model_model_language_model_layers_12_mlp_gate_proj_weight" + ], + "output": "linear_98", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_99", + "inputs": [ + "type_as_31", + "p_model_model_language_model_layers_12_mlp_up_proj_weight" + ], + "output": "linear_99", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_176", + "inputs": [ + "linear_98", + "linear_99" + ], + "output": "mul_176", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_100", + "inputs": [ + "mul_176", + "p_model_model_language_model_layers_12_mlp_down_proj_weight" + ], + "output": "linear_100", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_138", + "inputs": [ + "add_135", + "linear_100" + ], + "output": "add_138", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_178", + "inputs": [ + "add_138", + "p_model_model_language_model_layers_13_input_layernorm_weight" + ], + "output": "mul_178", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_32", + "inputs": [ + "mul_178" + ], + "output": "type_as_32", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_101", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_101", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_58", + "inputs": [ + "linear_101" + ], + "output": "transpose_58", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_102", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight" + ], + "output": "linear_102", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_85", + "inputs": [ + "linear_102" + ], + "output": "view_85", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_103", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight" + ], + "output": "linear_103", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_104", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight" + ], + "output": "linear_104", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_23", + "inputs": [ + "states_26", + "transpose_58" + ], + "output": "cat_23", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_120", + "inputs": [ + "cat_23" + ], + "output": "slice_120", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_26", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_10", + "inputs": [ + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight" + ], + "output": "squeeze_10", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_26", + "inputs": [ + "squeeze_10" + ], + "output": "unsqueeze_26", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_10", + "inputs": [ + "cat_23", + "unsqueeze_26" + ], + "output": "conv1d_10", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_121", + "inputs": [ + "conv1d_10" + ], + "output": "slice_121", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_33", + "inputs": [ + "slice_121" + ], + "output": "silu_33", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_122", + "inputs": [ + "silu_33" + ], + "output": "slice_122", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_59", + "inputs": [ + "slice_122" + ], + "output": "transpose_59", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_123", + "inputs": [ + "transpose_59" + ], + "output": "slice_123", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_124", + "inputs": [ + "transpose_59" + ], + "output": "slice_124", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_125", + "inputs": [ + "transpose_59" + ], + "output": "slice_125", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_86", + "inputs": [ + "slice_123" + ], + "output": "view_86", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_87", + "inputs": [ + "slice_124" + ], + "output": "view_87", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_88", + "inputs": [ + "slice_125" + ], + "output": "view_88", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_13", + "inputs": [ + "linear_103" + ], + "output": "sigmoid_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_10", + "inputs": [ + "p_model_model_language_model_layers_13_linear_attn_a_log" + ], + "output": "exp_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_16", + "inputs": [ + "exp_10" + ], + "output": "neg_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_141", + "inputs": [ + "linear_104", + "p_model_model_language_model_layers_13_linear_attn_dt_bias" + ], + "output": "add_141", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_10", + "inputs": [ + "add_141" + ], + "output": "softplus_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_179", + "inputs": [ + "neg_16", + "softplus_10" + ], + "output": "mul_179", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_180", + "inputs": [ + "view_86" + ], + "output": "mul_180", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_21", + "inputs": [ + "mul_180" + ], + "output": "sum_21", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_142", + "inputs": [ + "sum_21" + ], + "output": "add_142", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_63", + "inputs": [ + "add_142" + ], + "output": "rsqrt_63", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_181", + "inputs": [ + "view_86", + "rsqrt_63" + ], + "output": "mul_181", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_182", + "inputs": [ + "view_87" + ], + "output": "mul_182", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_22", + "inputs": [ + "mul_182" + ], + "output": "sum_22", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_143", + "inputs": [ + "sum_22" + ], + "output": "add_143", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_64", + "inputs": [ + "add_143" + ], + "output": "rsqrt_64", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_183", + "inputs": [ + "view_87", + "rsqrt_64" + ], + "output": "mul_183", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_10", + "inputs": [ + "mul_181", + "mul_183", + "view_88", + "mul_179", + "sigmoid_13", + "states_27" + ], + "output": "normalized_gated_delta_rule_10", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_126", + "inputs": [ + "normalized_gated_delta_rule_10" + ], + "output": "slice_126", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_27", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_127", + "inputs": [ + "normalized_gated_delta_rule_10" + ], + "output": "slice_127", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_60", + "inputs": [ + "slice_127" + ], + "output": "transpose_60", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_22", + "inputs": [ + "transpose_60" + ], + "output": "clone_22", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_89", + "inputs": [ + "clone_22" + ], + "output": "view_89", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_90", + "inputs": [ + "view_85" + ], + "output": "view_90", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_185", + "inputs": [ + "view_89", + "p_model_model_language_model_layers_13_linear_attn_norm_weight" + ], + "output": "mul_185", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_186", + "inputs": [ + "view_90", + "mul_185" + ], + "output": "mul_186", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_91", + "inputs": [ + "mul_186" + ], + "output": "view_91", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_105", + "inputs": [ + "view_91", + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight" + ], + "output": "linear_105", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_145", + "inputs": [ + "add_138", + "linear_105" + ], + "output": "add_145", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_188", + "inputs": [ + "add_145", + "p_model_model_language_model_layers_13_post_attention_layernorm_weight" + ], + "output": "mul_188", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_33", + "inputs": [ + "mul_188" + ], + "output": "type_as_33", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_106", + "inputs": [ + "type_as_33", + "p_model_model_language_model_layers_13_mlp_gate_proj_weight" + ], + "output": "linear_106", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_107", + "inputs": [ + "type_as_33", + "p_model_model_language_model_layers_13_mlp_up_proj_weight" + ], + "output": "linear_107", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_189", + "inputs": [ + "linear_106", + "linear_107" + ], + "output": "mul_189", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_108", + "inputs": [ + "mul_189", + "p_model_model_language_model_layers_13_mlp_down_proj_weight" + ], + "output": "linear_108", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_148", + "inputs": [ + "add_145", + "linear_108" + ], + "output": "add_148", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_191", + "inputs": [ + "add_148", + "p_model_model_language_model_layers_14_input_layernorm_weight" + ], + "output": "mul_191", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_34", + "inputs": [ + "mul_191" + ], + "output": "type_as_34", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_109", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_109", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_61", + "inputs": [ + "linear_109" + ], + "output": "transpose_61", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_110", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight" + ], + "output": "linear_110", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_92", + "inputs": [ + "linear_110" + ], + "output": "view_92", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_111", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight" + ], + "output": "linear_111", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_112", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight" + ], + "output": "linear_112", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_24", + "inputs": [ + "states_28", + "transpose_61" + ], + "output": "cat_24", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_128", + "inputs": [ + "cat_24" + ], + "output": "slice_128", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_28", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_11", + "inputs": [ + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight" + ], + "output": "squeeze_11", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_27", + "inputs": [ + "squeeze_11" + ], + "output": "unsqueeze_27", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_11", + "inputs": [ + "cat_24", + "unsqueeze_27" + ], + "output": "conv1d_11", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_129", + "inputs": [ + "conv1d_11" + ], + "output": "slice_129", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_36", + "inputs": [ + "slice_129" + ], + "output": "silu_36", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_130", + "inputs": [ + "silu_36" + ], + "output": "slice_130", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_62", + "inputs": [ + "slice_130" + ], + "output": "transpose_62", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_131", + "inputs": [ + "transpose_62" + ], + "output": "slice_131", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_132", + "inputs": [ + "transpose_62" + ], + "output": "slice_132", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_133", + "inputs": [ + "transpose_62" + ], + "output": "slice_133", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_93", + "inputs": [ + "slice_131" + ], + "output": "view_93", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_94", + "inputs": [ + "slice_132" + ], + "output": "view_94", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_95", + "inputs": [ + "slice_133" + ], + "output": "view_95", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_14", + "inputs": [ + "linear_111" + ], + "output": "sigmoid_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_11", + "inputs": [ + "p_model_model_language_model_layers_14_linear_attn_a_log" + ], + "output": "exp_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_17", + "inputs": [ + "exp_11" + ], + "output": "neg_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_151", + "inputs": [ + "linear_112", + "p_model_model_language_model_layers_14_linear_attn_dt_bias" + ], + "output": "add_151", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_11", + "inputs": [ + "add_151" + ], + "output": "softplus_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_192", + "inputs": [ + "neg_17", + "softplus_11" + ], + "output": "mul_192", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_193", + "inputs": [ + "view_93" + ], + "output": "mul_193", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_23", + "inputs": [ + "mul_193" + ], + "output": "sum_23", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_152", + "inputs": [ + "sum_23" + ], + "output": "add_152", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_68", + "inputs": [ + "add_152" + ], + "output": "rsqrt_68", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_194", + "inputs": [ + "view_93", + "rsqrt_68" + ], + "output": "mul_194", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_195", + "inputs": [ + "view_94" + ], + "output": "mul_195", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_24", + "inputs": [ + "mul_195" + ], + "output": "sum_24", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_153", + "inputs": [ + "sum_24" + ], + "output": "add_153", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_69", + "inputs": [ + "add_153" + ], + "output": "rsqrt_69", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_196", + "inputs": [ + "view_94", + "rsqrt_69" + ], + "output": "mul_196", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_11", + "inputs": [ + "mul_194", + "mul_196", + "view_95", + "mul_192", + "sigmoid_14", + "states_29" + ], + "output": "normalized_gated_delta_rule_11", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_134", + "inputs": [ + "normalized_gated_delta_rule_11" + ], + "output": "slice_134", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_29", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_135", + "inputs": [ + "normalized_gated_delta_rule_11" + ], + "output": "slice_135", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_63", + "inputs": [ + "slice_135" + ], + "output": "transpose_63", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_23", + "inputs": [ + "transpose_63" + ], + "output": "clone_23", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_96", + "inputs": [ + "clone_23" + ], + "output": "view_96", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_97", + "inputs": [ + "view_92" + ], + "output": "view_97", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_198", + "inputs": [ + "view_96", + "p_model_model_language_model_layers_14_linear_attn_norm_weight" + ], + "output": "mul_198", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_199", + "inputs": [ + "view_97", + "mul_198" + ], + "output": "mul_199", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_98", + "inputs": [ + "mul_199" + ], + "output": "view_98", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_113", + "inputs": [ + "view_98", + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight" + ], + "output": "linear_113", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_155", + "inputs": [ + "add_148", + "linear_113" + ], + "output": "add_155", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_201", + "inputs": [ + "add_155", + "p_model_model_language_model_layers_14_post_attention_layernorm_weight" + ], + "output": "mul_201", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_35", + "inputs": [ + "mul_201" + ], + "output": "type_as_35", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_114", + "inputs": [ + "type_as_35", + "p_model_model_language_model_layers_14_mlp_gate_proj_weight" + ], + "output": "linear_114", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_115", + "inputs": [ + "type_as_35", + "p_model_model_language_model_layers_14_mlp_up_proj_weight" + ], + "output": "linear_115", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_202", + "inputs": [ + "linear_114", + "linear_115" + ], + "output": "mul_202", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_116", + "inputs": [ + "mul_202", + "p_model_model_language_model_layers_14_mlp_down_proj_weight" + ], + "output": "linear_116", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_158", + "inputs": [ + "add_155", + "linear_116" + ], + "output": "add_158", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_204", + "inputs": [ + "add_158", + "p_model_model_language_model_layers_15_input_layernorm_weight" + ], + "output": "mul_204", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_36", + "inputs": [ + "mul_204" + ], + "output": "type_as_36", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_117", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_q_proj_weight" + ], + "output": "linear_117", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/809edbbbbbd45df1163aca9506775b9c2ae0d51f65a31a5396599cfeeb7009fc.wgsl" + }, + { + "node": "view_99", + "inputs": [ + "linear_117" + ], + "output": "view_99", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl" + }, + { + "node": "slice_136", + "inputs": [ + "view_99" + ], + "output": "slice_136", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl" + }, + { + "node": "slice_137", + "inputs": [ + "view_99" + ], + "output": "slice_137", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl" + }, + { + "node": "clone_24", + "inputs": [ + "slice_137" + ], + "output": "clone_24", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "_unsafe_view_9", + "inputs": [ + "clone_24" + ], + "output": "_unsafe_view_9", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_100", + "inputs": [ + "slice_136" + ], + "output": "view_100", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_206", + "inputs": [ + "view_100", + "p_model_model_language_model_layers_15_self_attn_q_norm_weight" + ], + "output": "mul_206", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_37", + "inputs": [ + "mul_206" + ], + "output": "type_as_37", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_64", + "inputs": [ + "type_as_37" + ], + "output": "transpose_64", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl" + }, + { + "node": "linear_118", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_k_proj_weight" + ], + "output": "linear_118", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_101", + "inputs": [ + "linear_118" + ], + "output": "view_101", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "mul_208", + "inputs": [ + "view_101", + "p_model_model_language_model_layers_15_self_attn_k_norm_weight" + ], + "output": "mul_208", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl" + }, + { + "node": "type_as_38", + "inputs": [ + "mul_208" + ], + "output": "type_as_38", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_65", + "inputs": [ + "type_as_38" + ], + "output": "transpose_65", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "linear_119", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_v_proj_weight" + ], + "output": "linear_119", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_102", + "inputs": [ + "linear_119" + ], + "output": "view_102", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_66", + "inputs": [ + "view_102" + ], + "output": "transpose_66", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "unsqueeze_28", + "inputs": [ + "mul" + ], + "output": "unsqueeze_28", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "unsqueeze_29", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_29", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "slice_138", + "inputs": [ + "transpose_64" + ], + "output": "slice_138", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl" + }, + { + "node": "slice_139", + "inputs": [ + "transpose_64" + ], + "output": "slice_139", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl" + }, + { + "node": "slice_140", + "inputs": [ + "transpose_65" + ], + "output": "slice_140", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl" + }, + { + "node": "slice_141", + "inputs": [ + "transpose_65" + ], + "output": "slice_141", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl" + }, + { + "node": "mul_209", + "inputs": [ + "slice_138", + "unsqueeze_28" + ], + "output": "mul_209", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "slice_142", + "inputs": [ + "slice_138" + ], + "output": "slice_142", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl" + }, + { + "node": "slice_143", + "inputs": [ + "slice_138" + ], + "output": "slice_143", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl" + }, + { + "node": "neg_18", + "inputs": [ + "slice_143" + ], + "output": "neg_18", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_25", + "inputs": [ + "neg_18", + "slice_142" + ], + "output": "cat_25", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_210", + "inputs": [ + "cat_25", + "unsqueeze_29" + ], + "output": "mul_210", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "add_165", + "inputs": [ + "mul_209", + "mul_210" + ], + "output": "add_165", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "mul_211", + "inputs": [ + "slice_140", + "unsqueeze_28" + ], + "output": "mul_211", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "slice_144", + "inputs": [ + "slice_140" + ], + "output": "slice_144", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl" + }, + { + "node": "slice_145", + "inputs": [ + "slice_140" + ], + "output": "slice_145", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl" + }, + { + "node": "neg_19", + "inputs": [ + "slice_145" + ], + "output": "neg_19", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl" + }, + { + "node": "cat_26", + "inputs": [ + "neg_19", + "slice_144" + ], + "output": "cat_26", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl" + }, + { + "node": "mul_212", + "inputs": [ + "cat_26", + "unsqueeze_29" + ], + "output": "mul_212", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "add_166", + "inputs": [ + "mul_211", + "mul_212" + ], + "output": "add_166", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl" + }, + { + "node": "cat_27", + "inputs": [ + "add_165", + "slice_139" + ], + "output": "cat_27", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cat_28", + "inputs": [ + "add_166", + "slice_141" + ], + "output": "cat_28", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl" + }, + { + "node": "cache_update_6", + "inputs": [ + "cat_28", + "cache_position" + ], + "output": "cache_update_6", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_30", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "cache_update_7", + "inputs": [ + "transpose_66", + "cache_position" + ], + "output": "cache_update_7", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_31", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "unsqueeze_30", + "inputs": [ + "cache_update_6" + ], + "output": "unsqueeze_30", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_7", + "inputs": [ + "unsqueeze_30" + ], + "output": "expand_7", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_25", + "inputs": [ + "expand_7" + ], + "output": "clone_25", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_10", + "inputs": [ + "clone_25" + ], + "output": "_unsafe_view_10", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_31", + "inputs": [ + "cache_update_7" + ], + "output": "unsqueeze_31", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_8", + "inputs": [ + "unsqueeze_31" + ], + "output": "expand_8", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_26", + "inputs": [ + "expand_8" + ], + "output": "clone_26", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_11", + "inputs": [ + "clone_26" + ], + "output": "_unsafe_view_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_67", + "inputs": [ + "_unsafe_view_10" + ], + "output": "transpose_67", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_7", + "inputs": [ + "cat_27", + "transpose_67" + ], + "output": "matmul_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl" + }, + { + "node": "mul_213", + "inputs": [ + "matmul_7" + ], + "output": "mul_213", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl" + }, + { + "node": "add_167", + "inputs": [ + "mul_213", + "attention_mask" + ], + "output": "add_167", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl" + }, + { + "node": "softmax_3", + "inputs": [ + "add_167" + ], + "output": "softmax_3", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl" + }, + { + "node": "matmul_8", + "inputs": [ + "softmax_3", + "_unsafe_view_11" + ], + "output": "matmul_8", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl" + }, + { + "node": "transpose_68", + "inputs": [ + "matmul_8" + ], + "output": "transpose_68", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl" + }, + { + "node": "clone_27", + "inputs": [ + "transpose_68" + ], + "output": "clone_27", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_103", + "inputs": [ + "clone_27" + ], + "output": "view_103", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_15", + "inputs": [ + "_unsafe_view_9" + ], + "output": "sigmoid_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl" + }, + { + "node": "mul_214", + "inputs": [ + "view_103", + "sigmoid_15" + ], + "output": "mul_214", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl" + }, + { + "node": "linear_120", + "inputs": [ + "mul_214", + "p_model_model_language_model_layers_15_self_attn_o_proj_weight" + ], + "output": "linear_120", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_168", + "inputs": [ + "add_158", + "linear_120" + ], + "output": "add_168", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_216", + "inputs": [ + "add_168", + "p_model_model_language_model_layers_15_post_attention_layernorm_weight" + ], + "output": "mul_216", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_39", + "inputs": [ + "mul_216" + ], + "output": "type_as_39", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_121", + "inputs": [ + "type_as_39", + "p_model_model_language_model_layers_15_mlp_gate_proj_weight" + ], + "output": "linear_121", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_122", + "inputs": [ + "type_as_39", + "p_model_model_language_model_layers_15_mlp_up_proj_weight" + ], + "output": "linear_122", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_217", + "inputs": [ + "linear_121", + "linear_122" + ], + "output": "mul_217", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_123", + "inputs": [ + "mul_217", + "p_model_model_language_model_layers_15_mlp_down_proj_weight" + ], + "output": "linear_123", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_171", + "inputs": [ + "add_168", + "linear_123" + ], + "output": "add_171", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_219", + "inputs": [ + "add_171", + "p_model_model_language_model_layers_16_input_layernorm_weight" + ], + "output": "mul_219", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_40", + "inputs": [ + "mul_219" + ], + "output": "type_as_40", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_124", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_124", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_69", + "inputs": [ + "linear_124" + ], + "output": "transpose_69", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_125", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight" + ], + "output": "linear_125", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_104", + "inputs": [ + "linear_125" + ], + "output": "view_104", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_126", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight" + ], + "output": "linear_126", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_127", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight" + ], + "output": "linear_127", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_29", + "inputs": [ + "states_32", + "transpose_69" + ], + "output": "cat_29", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_146", + "inputs": [ + "cat_29" + ], + "output": "slice_146", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_32", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_12", + "inputs": [ + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight" + ], + "output": "squeeze_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_32", + "inputs": [ + "squeeze_12" + ], + "output": "unsqueeze_32", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_12", + "inputs": [ + "cat_29", + "unsqueeze_32" + ], + "output": "conv1d_12", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_147", + "inputs": [ + "conv1d_12" + ], + "output": "slice_147", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_40", + "inputs": [ + "slice_147" + ], + "output": "silu_40", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_148", + "inputs": [ + "silu_40" + ], + "output": "slice_148", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_70", + "inputs": [ + "slice_148" + ], + "output": "transpose_70", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_149", + "inputs": [ + "transpose_70" + ], + "output": "slice_149", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_150", + "inputs": [ + "transpose_70" + ], + "output": "slice_150", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_151", + "inputs": [ + "transpose_70" + ], + "output": "slice_151", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_105", + "inputs": [ + "slice_149" + ], + "output": "view_105", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_106", + "inputs": [ + "slice_150" + ], + "output": "view_106", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_107", + "inputs": [ + "slice_151" + ], + "output": "view_107", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_16", + "inputs": [ + "linear_126" + ], + "output": "sigmoid_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_12", + "inputs": [ + "p_model_model_language_model_layers_16_linear_attn_a_log" + ], + "output": "exp_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_20", + "inputs": [ + "exp_12" + ], + "output": "neg_20", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_174", + "inputs": [ + "linear_127", + "p_model_model_language_model_layers_16_linear_attn_dt_bias" + ], + "output": "add_174", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_12", + "inputs": [ + "add_174" + ], + "output": "softplus_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_220", + "inputs": [ + "neg_20", + "softplus_12" + ], + "output": "mul_220", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_221", + "inputs": [ + "view_105" + ], + "output": "mul_221", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_25", + "inputs": [ + "mul_221" + ], + "output": "sum_25", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_175", + "inputs": [ + "sum_25" + ], + "output": "add_175", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_77", + "inputs": [ + "add_175" + ], + "output": "rsqrt_77", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_222", + "inputs": [ + "view_105", + "rsqrt_77" + ], + "output": "mul_222", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_223", + "inputs": [ + "view_106" + ], + "output": "mul_223", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_26", + "inputs": [ + "mul_223" + ], + "output": "sum_26", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_176", + "inputs": [ + "sum_26" + ], + "output": "add_176", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_78", + "inputs": [ + "add_176" + ], + "output": "rsqrt_78", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_224", + "inputs": [ + "view_106", + "rsqrt_78" + ], + "output": "mul_224", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_12", + "inputs": [ + "mul_222", + "mul_224", + "view_107", + "mul_220", + "sigmoid_16", + "states_33" + ], + "output": "normalized_gated_delta_rule_12", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_152", + "inputs": [ + "normalized_gated_delta_rule_12" + ], + "output": "slice_152", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_33", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_153", + "inputs": [ + "normalized_gated_delta_rule_12" + ], + "output": "slice_153", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_71", + "inputs": [ + "slice_153" + ], + "output": "transpose_71", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_28", + "inputs": [ + "transpose_71" + ], + "output": "clone_28", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_108", + "inputs": [ + "clone_28" + ], + "output": "view_108", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_109", + "inputs": [ + "view_104" + ], + "output": "view_109", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_226", + "inputs": [ + "view_108", + "p_model_model_language_model_layers_16_linear_attn_norm_weight" + ], + "output": "mul_226", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_227", + "inputs": [ + "view_109", + "mul_226" + ], + "output": "mul_227", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_110", + "inputs": [ + "mul_227" + ], + "output": "view_110", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_128", + "inputs": [ + "view_110", + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight" + ], + "output": "linear_128", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_178", + "inputs": [ + "add_171", + "linear_128" + ], + "output": "add_178", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_229", + "inputs": [ + "add_178", + "p_model_model_language_model_layers_16_post_attention_layernorm_weight" + ], + "output": "mul_229", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_41", + "inputs": [ + "mul_229" + ], + "output": "type_as_41", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_129", + "inputs": [ + "type_as_41", + "p_model_model_language_model_layers_16_mlp_gate_proj_weight" + ], + "output": "linear_129", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_130", + "inputs": [ + "type_as_41", + "p_model_model_language_model_layers_16_mlp_up_proj_weight" + ], + "output": "linear_130", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_230", + "inputs": [ + "linear_129", + "linear_130" + ], + "output": "mul_230", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_131", + "inputs": [ + "mul_230", + "p_model_model_language_model_layers_16_mlp_down_proj_weight" + ], + "output": "linear_131", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_181", + "inputs": [ + "add_178", + "linear_131" + ], + "output": "add_181", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_232", + "inputs": [ + "add_181", + "p_model_model_language_model_layers_17_input_layernorm_weight" + ], + "output": "mul_232", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_42", + "inputs": [ + "mul_232" + ], + "output": "type_as_42", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_132", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_132", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_72", + "inputs": [ + "linear_132" + ], + "output": "transpose_72", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_133", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight" + ], + "output": "linear_133", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_111", + "inputs": [ + "linear_133" + ], + "output": "view_111", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_134", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight" + ], + "output": "linear_134", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_135", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight" + ], + "output": "linear_135", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_30", + "inputs": [ + "states_34", + "transpose_72" + ], + "output": "cat_30", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_154", + "inputs": [ + "cat_30" + ], + "output": "slice_154", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_34", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_13", + "inputs": [ + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight" + ], + "output": "squeeze_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_33", + "inputs": [ + "squeeze_13" + ], + "output": "unsqueeze_33", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_13", + "inputs": [ + "cat_30", + "unsqueeze_33" + ], + "output": "conv1d_13", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_155", + "inputs": [ + "conv1d_13" + ], + "output": "slice_155", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_43", + "inputs": [ + "slice_155" + ], + "output": "silu_43", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_156", + "inputs": [ + "silu_43" + ], + "output": "slice_156", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_73", + "inputs": [ + "slice_156" + ], + "output": "transpose_73", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_157", + "inputs": [ + "transpose_73" + ], + "output": "slice_157", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_158", + "inputs": [ + "transpose_73" + ], + "output": "slice_158", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_159", + "inputs": [ + "transpose_73" + ], + "output": "slice_159", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_112", + "inputs": [ + "slice_157" + ], + "output": "view_112", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_113", + "inputs": [ + "slice_158" + ], + "output": "view_113", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_114", + "inputs": [ + "slice_159" + ], + "output": "view_114", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_17", + "inputs": [ + "linear_134" + ], + "output": "sigmoid_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_13", + "inputs": [ + "p_model_model_language_model_layers_17_linear_attn_a_log" + ], + "output": "exp_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_21", + "inputs": [ + "exp_13" + ], + "output": "neg_21", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_184", + "inputs": [ + "linear_135", + "p_model_model_language_model_layers_17_linear_attn_dt_bias" + ], + "output": "add_184", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_13", + "inputs": [ + "add_184" + ], + "output": "softplus_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_233", + "inputs": [ + "neg_21", + "softplus_13" + ], + "output": "mul_233", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_234", + "inputs": [ + "view_112" + ], + "output": "mul_234", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_27", + "inputs": [ + "mul_234" + ], + "output": "sum_27", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_185", + "inputs": [ + "sum_27" + ], + "output": "add_185", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_82", + "inputs": [ + "add_185" + ], + "output": "rsqrt_82", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_235", + "inputs": [ + "view_112", + "rsqrt_82" + ], + "output": "mul_235", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_236", + "inputs": [ + "view_113" + ], + "output": "mul_236", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_28", + "inputs": [ + "mul_236" + ], + "output": "sum_28", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_186", + "inputs": [ + "sum_28" + ], + "output": "add_186", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_83", + "inputs": [ + "add_186" + ], + "output": "rsqrt_83", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_237", + "inputs": [ + "view_113", + "rsqrt_83" + ], + "output": "mul_237", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_13", + "inputs": [ + "mul_235", + "mul_237", + "view_114", + "mul_233", + "sigmoid_17", + "states_35" + ], + "output": "normalized_gated_delta_rule_13", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_160", + "inputs": [ + "normalized_gated_delta_rule_13" + ], + "output": "slice_160", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_35", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_161", + "inputs": [ + "normalized_gated_delta_rule_13" + ], + "output": "slice_161", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_74", + "inputs": [ + "slice_161" + ], + "output": "transpose_74", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_29", + "inputs": [ + "transpose_74" + ], + "output": "clone_29", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_115", + "inputs": [ + "clone_29" + ], + "output": "view_115", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_116", + "inputs": [ + "view_111" + ], + "output": "view_116", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_239", + "inputs": [ + "view_115", + "p_model_model_language_model_layers_17_linear_attn_norm_weight" + ], + "output": "mul_239", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_240", + "inputs": [ + "view_116", + "mul_239" + ], + "output": "mul_240", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_117", + "inputs": [ + "mul_240" + ], + "output": "view_117", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_136", + "inputs": [ + "view_117", + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight" + ], + "output": "linear_136", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_188", + "inputs": [ + "add_181", + "linear_136" + ], + "output": "add_188", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_242", + "inputs": [ + "add_188", + "p_model_model_language_model_layers_17_post_attention_layernorm_weight" + ], + "output": "mul_242", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_43", + "inputs": [ + "mul_242" + ], + "output": "type_as_43", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_137", + "inputs": [ + "type_as_43", + "p_model_model_language_model_layers_17_mlp_gate_proj_weight" + ], + "output": "linear_137", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_138", + "inputs": [ + "type_as_43", + "p_model_model_language_model_layers_17_mlp_up_proj_weight" + ], + "output": "linear_138", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_243", + "inputs": [ + "linear_137", + "linear_138" + ], + "output": "mul_243", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_139", + "inputs": [ + "mul_243", + "p_model_model_language_model_layers_17_mlp_down_proj_weight" + ], + "output": "linear_139", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_191", + "inputs": [ + "add_188", + "linear_139" + ], + "output": "add_191", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_245", + "inputs": [ + "add_191", + "p_model_model_language_model_layers_18_input_layernorm_weight" + ], + "output": "mul_245", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_44", + "inputs": [ + "mul_245" + ], + "output": "type_as_44", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_140", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_140", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_75", + "inputs": [ + "linear_140" + ], + "output": "transpose_75", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_141", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight" + ], + "output": "linear_141", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_118", + "inputs": [ + "linear_141" + ], + "output": "view_118", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_142", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight" + ], + "output": "linear_142", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_143", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight" + ], + "output": "linear_143", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_31", + "inputs": [ + "states_36", + "transpose_75" + ], + "output": "cat_31", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_162", + "inputs": [ + "cat_31" + ], + "output": "slice_162", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_36", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_14", + "inputs": [ + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight" + ], + "output": "squeeze_14", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_34", + "inputs": [ + "squeeze_14" + ], + "output": "unsqueeze_34", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_14", + "inputs": [ + "cat_31", + "unsqueeze_34" + ], + "output": "conv1d_14", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_163", + "inputs": [ + "conv1d_14" + ], + "output": "slice_163", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_46", + "inputs": [ + "slice_163" + ], + "output": "silu_46", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_164", + "inputs": [ + "silu_46" + ], + "output": "slice_164", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_76", + "inputs": [ + "slice_164" + ], + "output": "transpose_76", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_165", + "inputs": [ + "transpose_76" + ], + "output": "slice_165", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_166", + "inputs": [ + "transpose_76" + ], + "output": "slice_166", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_167", + "inputs": [ + "transpose_76" + ], + "output": "slice_167", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_119", + "inputs": [ + "slice_165" + ], + "output": "view_119", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_120", + "inputs": [ + "slice_166" + ], + "output": "view_120", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_121", + "inputs": [ + "slice_167" + ], + "output": "view_121", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_18", + "inputs": [ + "linear_142" + ], + "output": "sigmoid_18", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_14", + "inputs": [ + "p_model_model_language_model_layers_18_linear_attn_a_log" + ], + "output": "exp_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_22", + "inputs": [ + "exp_14" + ], + "output": "neg_22", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_194", + "inputs": [ + "linear_143", + "p_model_model_language_model_layers_18_linear_attn_dt_bias" + ], + "output": "add_194", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_14", + "inputs": [ + "add_194" + ], + "output": "softplus_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_246", + "inputs": [ + "neg_22", + "softplus_14" + ], + "output": "mul_246", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_247", + "inputs": [ + "view_119" + ], + "output": "mul_247", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_29", + "inputs": [ + "mul_247" + ], + "output": "sum_29", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_195", + "inputs": [ + "sum_29" + ], + "output": "add_195", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_87", + "inputs": [ + "add_195" + ], + "output": "rsqrt_87", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_248", + "inputs": [ + "view_119", + "rsqrt_87" + ], + "output": "mul_248", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_249", + "inputs": [ + "view_120" + ], + "output": "mul_249", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_30", + "inputs": [ + "mul_249" + ], + "output": "sum_30", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_196", + "inputs": [ + "sum_30" + ], + "output": "add_196", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_88", + "inputs": [ + "add_196" + ], + "output": "rsqrt_88", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_250", + "inputs": [ + "view_120", + "rsqrt_88" + ], + "output": "mul_250", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_14", + "inputs": [ + "mul_248", + "mul_250", + "view_121", + "mul_246", + "sigmoid_18", + "states_37" + ], + "output": "normalized_gated_delta_rule_14", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_168", + "inputs": [ + "normalized_gated_delta_rule_14" + ], + "output": "slice_168", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_37", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_169", + "inputs": [ + "normalized_gated_delta_rule_14" + ], + "output": "slice_169", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_77", + "inputs": [ + "slice_169" + ], + "output": "transpose_77", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_30", + "inputs": [ + "transpose_77" + ], + "output": "clone_30", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_122", + "inputs": [ + "clone_30" + ], + "output": "view_122", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_123", + "inputs": [ + "view_118" + ], + "output": "view_123", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_252", + "inputs": [ + "view_122", + "p_model_model_language_model_layers_18_linear_attn_norm_weight" + ], + "output": "mul_252", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_253", + "inputs": [ + "view_123", + "mul_252" + ], + "output": "mul_253", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_124", + "inputs": [ + "mul_253" + ], + "output": "view_124", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_144", + "inputs": [ + "view_124", + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight" + ], + "output": "linear_144", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_198", + "inputs": [ + "add_191", + "linear_144" + ], + "output": "add_198", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_255", + "inputs": [ + "add_198", + "p_model_model_language_model_layers_18_post_attention_layernorm_weight" + ], + "output": "mul_255", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_45", + "inputs": [ + "mul_255" + ], + "output": "type_as_45", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_145", + "inputs": [ + "type_as_45", + "p_model_model_language_model_layers_18_mlp_gate_proj_weight" + ], + "output": "linear_145", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_146", + "inputs": [ + "type_as_45", + "p_model_model_language_model_layers_18_mlp_up_proj_weight" + ], + "output": "linear_146", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_256", + "inputs": [ + "linear_145", + "linear_146" + ], + "output": "mul_256", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_147", + "inputs": [ + "mul_256", + "p_model_model_language_model_layers_18_mlp_down_proj_weight" + ], + "output": "linear_147", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_201", + "inputs": [ + "add_198", + "linear_147" + ], + "output": "add_201", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_258", + "inputs": [ + "add_201", + "p_model_model_language_model_layers_19_input_layernorm_weight" + ], + "output": "mul_258", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_46", + "inputs": [ + "mul_258" + ], + "output": "type_as_46", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_148", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_q_proj_weight" + ], + "output": "linear_148", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/809edbbbbbd45df1163aca9506775b9c2ae0d51f65a31a5396599cfeeb7009fc.wgsl" + }, + { + "node": "view_125", + "inputs": [ + "linear_148" + ], + "output": "view_125", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl" + }, + { + "node": "slice_170", + "inputs": [ + "view_125" + ], + "output": "slice_170", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl" + }, + { + "node": "slice_171", + "inputs": [ + "view_125" + ], + "output": "slice_171", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl" + }, + { + "node": "clone_31", + "inputs": [ + "slice_171" + ], + "output": "clone_31", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "_unsafe_view_12", + "inputs": [ + "clone_31" + ], + "output": "_unsafe_view_12", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_126", + "inputs": [ + "slice_170" + ], + "output": "view_126", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_260", + "inputs": [ + "view_126", + "p_model_model_language_model_layers_19_self_attn_q_norm_weight" + ], + "output": "mul_260", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_47", + "inputs": [ + "mul_260" + ], + "output": "type_as_47", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_78", + "inputs": [ + "type_as_47" + ], + "output": "transpose_78", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl" + }, + { + "node": "linear_149", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_k_proj_weight" + ], + "output": "linear_149", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_127", + "inputs": [ + "linear_149" + ], + "output": "view_127", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "mul_262", + "inputs": [ + "view_127", + "p_model_model_language_model_layers_19_self_attn_k_norm_weight" + ], + "output": "mul_262", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl" + }, + { + "node": "type_as_48", + "inputs": [ + "mul_262" + ], + "output": "type_as_48", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_79", + "inputs": [ + "type_as_48" + ], + "output": "transpose_79", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "linear_150", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_v_proj_weight" + ], + "output": "linear_150", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_128", + "inputs": [ + "linear_150" + ], + "output": "view_128", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_80", + "inputs": [ + "view_128" + ], + "output": "transpose_80", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "unsqueeze_35", + "inputs": [ + "mul" + ], + "output": "unsqueeze_35", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "unsqueeze_36", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_36", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "slice_172", + "inputs": [ + "transpose_78" + ], + "output": "slice_172", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl" + }, + { + "node": "slice_173", + "inputs": [ + "transpose_78" + ], + "output": "slice_173", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl" + }, + { + "node": "slice_174", + "inputs": [ + "transpose_79" + ], + "output": "slice_174", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl" + }, + { + "node": "slice_175", + "inputs": [ + "transpose_79" + ], + "output": "slice_175", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl" + }, + { + "node": "mul_263", + "inputs": [ + "slice_172", + "unsqueeze_35" + ], + "output": "mul_263", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "slice_176", + "inputs": [ + "slice_172" + ], + "output": "slice_176", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl" + }, + { + "node": "slice_177", + "inputs": [ + "slice_172" + ], + "output": "slice_177", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl" + }, + { + "node": "neg_23", + "inputs": [ + "slice_177" + ], + "output": "neg_23", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_32", + "inputs": [ + "neg_23", + "slice_176" + ], + "output": "cat_32", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_264", + "inputs": [ + "cat_32", + "unsqueeze_36" + ], + "output": "mul_264", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "add_208", + "inputs": [ + "mul_263", + "mul_264" + ], + "output": "add_208", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "mul_265", + "inputs": [ + "slice_174", + "unsqueeze_35" + ], + "output": "mul_265", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "slice_178", + "inputs": [ + "slice_174" + ], + "output": "slice_178", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl" + }, + { + "node": "slice_179", + "inputs": [ + "slice_174" + ], + "output": "slice_179", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl" + }, + { + "node": "neg_24", + "inputs": [ + "slice_179" + ], + "output": "neg_24", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl" + }, + { + "node": "cat_33", + "inputs": [ + "neg_24", + "slice_178" + ], + "output": "cat_33", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl" + }, + { + "node": "mul_266", + "inputs": [ + "cat_33", + "unsqueeze_36" + ], + "output": "mul_266", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "add_209", + "inputs": [ + "mul_265", + "mul_266" + ], + "output": "add_209", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl" + }, + { + "node": "cat_34", + "inputs": [ + "add_208", + "slice_173" + ], + "output": "cat_34", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cat_35", + "inputs": [ + "add_209", + "slice_175" + ], + "output": "cat_35", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl" + }, + { + "node": "cache_update_8", + "inputs": [ + "cat_35", + "cache_position" + ], + "output": "cache_update_8", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_38", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "cache_update_9", + "inputs": [ + "transpose_80", + "cache_position" + ], + "output": "cache_update_9", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_39", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "unsqueeze_37", + "inputs": [ + "cache_update_8" + ], + "output": "unsqueeze_37", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_9", + "inputs": [ + "unsqueeze_37" + ], + "output": "expand_9", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_32", + "inputs": [ + "expand_9" + ], + "output": "clone_32", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_13", + "inputs": [ + "clone_32" + ], + "output": "_unsafe_view_13", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_38", + "inputs": [ + "cache_update_9" + ], + "output": "unsqueeze_38", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_10", + "inputs": [ + "unsqueeze_38" + ], + "output": "expand_10", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_33", + "inputs": [ + "expand_10" + ], + "output": "clone_33", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_14", + "inputs": [ + "clone_33" + ], + "output": "_unsafe_view_14", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_81", + "inputs": [ + "_unsafe_view_13" + ], + "output": "transpose_81", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_9", + "inputs": [ + "cat_34", + "transpose_81" + ], + "output": "matmul_9", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl" + }, + { + "node": "mul_267", + "inputs": [ + "matmul_9" + ], + "output": "mul_267", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl" + }, + { + "node": "add_210", + "inputs": [ + "mul_267", + "attention_mask" + ], + "output": "add_210", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl" + }, + { + "node": "softmax_4", + "inputs": [ + "add_210" + ], + "output": "softmax_4", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl" + }, + { + "node": "matmul_10", + "inputs": [ + "softmax_4", + "_unsafe_view_14" + ], + "output": "matmul_10", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl" + }, + { + "node": "transpose_82", + "inputs": [ + "matmul_10" + ], + "output": "transpose_82", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl" + }, + { + "node": "clone_34", + "inputs": [ + "transpose_82" + ], + "output": "clone_34", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_129", + "inputs": [ + "clone_34" + ], + "output": "view_129", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_19", + "inputs": [ + "_unsafe_view_12" + ], + "output": "sigmoid_19", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl" + }, + { + "node": "mul_268", + "inputs": [ + "view_129", + "sigmoid_19" + ], + "output": "mul_268", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl" + }, + { + "node": "linear_151", + "inputs": [ + "mul_268", + "p_model_model_language_model_layers_19_self_attn_o_proj_weight" + ], + "output": "linear_151", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_211", + "inputs": [ + "add_201", + "linear_151" + ], + "output": "add_211", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_270", + "inputs": [ + "add_211", + "p_model_model_language_model_layers_19_post_attention_layernorm_weight" + ], + "output": "mul_270", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_49", + "inputs": [ + "mul_270" + ], + "output": "type_as_49", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_152", + "inputs": [ + "type_as_49", + "p_model_model_language_model_layers_19_mlp_gate_proj_weight" + ], + "output": "linear_152", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_153", + "inputs": [ + "type_as_49", + "p_model_model_language_model_layers_19_mlp_up_proj_weight" + ], + "output": "linear_153", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_271", + "inputs": [ + "linear_152", + "linear_153" + ], + "output": "mul_271", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_154", + "inputs": [ + "mul_271", + "p_model_model_language_model_layers_19_mlp_down_proj_weight" + ], + "output": "linear_154", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_214", + "inputs": [ + "add_211", + "linear_154" + ], + "output": "add_214", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_273", + "inputs": [ + "add_214", + "p_model_model_language_model_layers_20_input_layernorm_weight" + ], + "output": "mul_273", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_50", + "inputs": [ + "mul_273" + ], + "output": "type_as_50", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_155", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_155", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_83", + "inputs": [ + "linear_155" + ], + "output": "transpose_83", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_156", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight" + ], + "output": "linear_156", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_130", + "inputs": [ + "linear_156" + ], + "output": "view_130", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_157", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight" + ], + "output": "linear_157", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_158", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight" + ], + "output": "linear_158", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_36", + "inputs": [ + "states_40", + "transpose_83" + ], + "output": "cat_36", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_180", + "inputs": [ + "cat_36" + ], + "output": "slice_180", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_40", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_15", + "inputs": [ + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight" + ], + "output": "squeeze_15", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_39", + "inputs": [ + "squeeze_15" + ], + "output": "unsqueeze_39", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_15", + "inputs": [ + "cat_36", + "unsqueeze_39" + ], + "output": "conv1d_15", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_181", + "inputs": [ + "conv1d_15" + ], + "output": "slice_181", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_50", + "inputs": [ + "slice_181" + ], + "output": "silu_50", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_182", + "inputs": [ + "silu_50" + ], + "output": "slice_182", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_84", + "inputs": [ + "slice_182" + ], + "output": "transpose_84", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_183", + "inputs": [ + "transpose_84" + ], + "output": "slice_183", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_184", + "inputs": [ + "transpose_84" + ], + "output": "slice_184", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_185", + "inputs": [ + "transpose_84" + ], + "output": "slice_185", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_131", + "inputs": [ + "slice_183" + ], + "output": "view_131", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_132", + "inputs": [ + "slice_184" + ], + "output": "view_132", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_133", + "inputs": [ + "slice_185" + ], + "output": "view_133", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_20", + "inputs": [ + "linear_157" + ], + "output": "sigmoid_20", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_15", + "inputs": [ + "p_model_model_language_model_layers_20_linear_attn_a_log" + ], + "output": "exp_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_25", + "inputs": [ + "exp_15" + ], + "output": "neg_25", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_217", + "inputs": [ + "linear_158", + "p_model_model_language_model_layers_20_linear_attn_dt_bias" + ], + "output": "add_217", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_15", + "inputs": [ + "add_217" + ], + "output": "softplus_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_274", + "inputs": [ + "neg_25", + "softplus_15" + ], + "output": "mul_274", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_275", + "inputs": [ + "view_131" + ], + "output": "mul_275", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_31", + "inputs": [ + "mul_275" + ], + "output": "sum_31", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_218", + "inputs": [ + "sum_31" + ], + "output": "add_218", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_96", + "inputs": [ + "add_218" + ], + "output": "rsqrt_96", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_276", + "inputs": [ + "view_131", + "rsqrt_96" + ], + "output": "mul_276", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_277", + "inputs": [ + "view_132" + ], + "output": "mul_277", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_32", + "inputs": [ + "mul_277" + ], + "output": "sum_32", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_219", + "inputs": [ + "sum_32" + ], + "output": "add_219", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_97", + "inputs": [ + "add_219" + ], + "output": "rsqrt_97", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_278", + "inputs": [ + "view_132", + "rsqrt_97" + ], + "output": "mul_278", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_15", + "inputs": [ + "mul_276", + "mul_278", + "view_133", + "mul_274", + "sigmoid_20", + "states_41" + ], + "output": "normalized_gated_delta_rule_15", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_186", + "inputs": [ + "normalized_gated_delta_rule_15" + ], + "output": "slice_186", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_41", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_187", + "inputs": [ + "normalized_gated_delta_rule_15" + ], + "output": "slice_187", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_85", + "inputs": [ + "slice_187" + ], + "output": "transpose_85", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_35", + "inputs": [ + "transpose_85" + ], + "output": "clone_35", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_134", + "inputs": [ + "clone_35" + ], + "output": "view_134", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_135", + "inputs": [ + "view_130" + ], + "output": "view_135", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_280", + "inputs": [ + "view_134", + "p_model_model_language_model_layers_20_linear_attn_norm_weight" + ], + "output": "mul_280", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_281", + "inputs": [ + "view_135", + "mul_280" + ], + "output": "mul_281", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_136", + "inputs": [ + "mul_281" + ], + "output": "view_136", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_159", + "inputs": [ + "view_136", + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight" + ], + "output": "linear_159", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_221", + "inputs": [ + "add_214", + "linear_159" + ], + "output": "add_221", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_283", + "inputs": [ + "add_221", + "p_model_model_language_model_layers_20_post_attention_layernorm_weight" + ], + "output": "mul_283", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_51", + "inputs": [ + "mul_283" + ], + "output": "type_as_51", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_160", + "inputs": [ + "type_as_51", + "p_model_model_language_model_layers_20_mlp_gate_proj_weight" + ], + "output": "linear_160", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_161", + "inputs": [ + "type_as_51", + "p_model_model_language_model_layers_20_mlp_up_proj_weight" + ], + "output": "linear_161", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_284", + "inputs": [ + "linear_160", + "linear_161" + ], + "output": "mul_284", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_162", + "inputs": [ + "mul_284", + "p_model_model_language_model_layers_20_mlp_down_proj_weight" + ], + "output": "linear_162", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_224", + "inputs": [ + "add_221", + "linear_162" + ], + "output": "add_224", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_286", + "inputs": [ + "add_224", + "p_model_model_language_model_layers_21_input_layernorm_weight" + ], + "output": "mul_286", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_52", + "inputs": [ + "mul_286" + ], + "output": "type_as_52", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_163", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_163", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_86", + "inputs": [ + "linear_163" + ], + "output": "transpose_86", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_164", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight" + ], + "output": "linear_164", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_137", + "inputs": [ + "linear_164" + ], + "output": "view_137", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_165", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight" + ], + "output": "linear_165", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_166", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight" + ], + "output": "linear_166", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_37", + "inputs": [ + "states_42", + "transpose_86" + ], + "output": "cat_37", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_188", + "inputs": [ + "cat_37" + ], + "output": "slice_188", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_42", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_16", + "inputs": [ + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight" + ], + "output": "squeeze_16", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_40", + "inputs": [ + "squeeze_16" + ], + "output": "unsqueeze_40", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_16", + "inputs": [ + "cat_37", + "unsqueeze_40" + ], + "output": "conv1d_16", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_189", + "inputs": [ + "conv1d_16" + ], + "output": "slice_189", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_53", + "inputs": [ + "slice_189" + ], + "output": "silu_53", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_190", + "inputs": [ + "silu_53" + ], + "output": "slice_190", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_87", + "inputs": [ + "slice_190" + ], + "output": "transpose_87", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_191", + "inputs": [ + "transpose_87" + ], + "output": "slice_191", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_192", + "inputs": [ + "transpose_87" + ], + "output": "slice_192", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_193", + "inputs": [ + "transpose_87" + ], + "output": "slice_193", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_138", + "inputs": [ + "slice_191" + ], + "output": "view_138", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_139", + "inputs": [ + "slice_192" + ], + "output": "view_139", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_140", + "inputs": [ + "slice_193" + ], + "output": "view_140", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_21", + "inputs": [ + "linear_165" + ], + "output": "sigmoid_21", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_16", + "inputs": [ + "p_model_model_language_model_layers_21_linear_attn_a_log" + ], + "output": "exp_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_26", + "inputs": [ + "exp_16" + ], + "output": "neg_26", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_227", + "inputs": [ + "linear_166", + "p_model_model_language_model_layers_21_linear_attn_dt_bias" + ], + "output": "add_227", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_16", + "inputs": [ + "add_227" + ], + "output": "softplus_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_287", + "inputs": [ + "neg_26", + "softplus_16" + ], + "output": "mul_287", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_288", + "inputs": [ + "view_138" + ], + "output": "mul_288", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_33", + "inputs": [ + "mul_288" + ], + "output": "sum_33", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_228", + "inputs": [ + "sum_33" + ], + "output": "add_228", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_101", + "inputs": [ + "add_228" + ], + "output": "rsqrt_101", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_289", + "inputs": [ + "view_138", + "rsqrt_101" + ], + "output": "mul_289", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_290", + "inputs": [ + "view_139" + ], + "output": "mul_290", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_34", + "inputs": [ + "mul_290" + ], + "output": "sum_34", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_229", + "inputs": [ + "sum_34" + ], + "output": "add_229", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_102", + "inputs": [ + "add_229" + ], + "output": "rsqrt_102", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_291", + "inputs": [ + "view_139", + "rsqrt_102" + ], + "output": "mul_291", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_16", + "inputs": [ + "mul_289", + "mul_291", + "view_140", + "mul_287", + "sigmoid_21", + "states_43" + ], + "output": "normalized_gated_delta_rule_16", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_194", + "inputs": [ + "normalized_gated_delta_rule_16" + ], + "output": "slice_194", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_43", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_195", + "inputs": [ + "normalized_gated_delta_rule_16" + ], + "output": "slice_195", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_88", + "inputs": [ + "slice_195" + ], + "output": "transpose_88", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_36", + "inputs": [ + "transpose_88" + ], + "output": "clone_36", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_141", + "inputs": [ + "clone_36" + ], + "output": "view_141", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_142", + "inputs": [ + "view_137" + ], + "output": "view_142", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_293", + "inputs": [ + "view_141", + "p_model_model_language_model_layers_21_linear_attn_norm_weight" + ], + "output": "mul_293", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_294", + "inputs": [ + "view_142", + "mul_293" + ], + "output": "mul_294", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_143", + "inputs": [ + "mul_294" + ], + "output": "view_143", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_167", + "inputs": [ + "view_143", + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight" + ], + "output": "linear_167", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_231", + "inputs": [ + "add_224", + "linear_167" + ], + "output": "add_231", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_296", + "inputs": [ + "add_231", + "p_model_model_language_model_layers_21_post_attention_layernorm_weight" + ], + "output": "mul_296", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_53", + "inputs": [ + "mul_296" + ], + "output": "type_as_53", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_168", + "inputs": [ + "type_as_53", + "p_model_model_language_model_layers_21_mlp_gate_proj_weight" + ], + "output": "linear_168", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_169", + "inputs": [ + "type_as_53", + "p_model_model_language_model_layers_21_mlp_up_proj_weight" + ], + "output": "linear_169", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_297", + "inputs": [ + "linear_168", + "linear_169" + ], + "output": "mul_297", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_170", + "inputs": [ + "mul_297", + "p_model_model_language_model_layers_21_mlp_down_proj_weight" + ], + "output": "linear_170", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_234", + "inputs": [ + "add_231", + "linear_170" + ], + "output": "add_234", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_299", + "inputs": [ + "add_234", + "p_model_model_language_model_layers_22_input_layernorm_weight" + ], + "output": "mul_299", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_54", + "inputs": [ + "mul_299" + ], + "output": "type_as_54", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_171", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_171", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "transpose_89", + "inputs": [ + "linear_171" + ], + "output": "transpose_89", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl" + }, + { + "node": "linear_172", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight" + ], + "output": "linear_172", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "view_144", + "inputs": [ + "linear_172" + ], + "output": "view_144", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_173", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight" + ], + "output": "linear_173", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "linear_174", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight" + ], + "output": "linear_174", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl" + }, + { + "node": "cat_38", + "inputs": [ + "states_44", + "transpose_89" + ], + "output": "cat_38", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/4d46494a55ac0b66fdddd47b9422106ac39e0c7d206f01004e13f93a010e1bf5.wgsl" + }, + { + "node": "slice_196", + "inputs": [ + "cat_38" + ], + "output": "slice_196", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_44", + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "squeeze_17", + "inputs": [ + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight" + ], + "output": "squeeze_17", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_41", + "inputs": [ + "squeeze_17" + ], + "output": "unsqueeze_41", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_17", + "inputs": [ + "cat_38", + "unsqueeze_41" + ], + "output": "conv1d_17", + "workgroups": [ + 1056, + 1, + 1 + ], + "kernel": "kernels/7fed7072c20dc3e66c80b2ac1f737b0e7e70a695e5db34e057f729c945e60ba0.wgsl" + }, + { + "node": "slice_197", + "inputs": [ + "conv1d_17" + ], + "output": "slice_197", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/84ff996d084cbc6b8dca21a8f3267cdb1f4c6b9664c24c3002252f05247c4212.wgsl" + }, + { + "node": "silu_56", + "inputs": [ + "slice_197" + ], + "output": "silu_56", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/b6c3ce0defd66eef66dc3fd6eb9eab3fee12d179332698c3c764009988628b49.wgsl" + }, + { + "node": "slice_198", + "inputs": [ + "silu_56" + ], + "output": "slice_198", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/987d27946334b53b3006cdca1a7158b13a27e01e688047aeafc4b029761b80af.wgsl" + }, + { + "node": "transpose_90", + "inputs": [ + "slice_198" + ], + "output": "transpose_90", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/fa90a055381629df20c59052b5e44670510dd1666b9f2b06a554dfed9a002953.wgsl" + }, + { + "node": "slice_199", + "inputs": [ + "transpose_90" + ], + "output": "slice_199", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e74eaedc2b731f96007caaea3db1518767845c24bc917b9c2b71553e22139130.wgsl" + }, + { + "node": "slice_200", + "inputs": [ + "transpose_90" + ], + "output": "slice_200", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a9f0eef095f015e2099adf81552a6727c45e70fc11f5e50b777d36b6370ab986.wgsl" + }, + { + "node": "slice_201", + "inputs": [ + "transpose_90" + ], + "output": "slice_201", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl" + }, + { + "node": "view_145", + "inputs": [ + "slice_199" + ], + "output": "view_145", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_146", + "inputs": [ + "slice_200" + ], + "output": "view_146", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_147", + "inputs": [ + "slice_201" + ], + "output": "view_147", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_22", + "inputs": [ + "linear_173" + ], + "output": "sigmoid_22", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f233dea95d020538ac476af9846f67cba0d137fd562d5f652cb333f0b3273c76.wgsl" + }, + { + "node": "exp_17", + "inputs": [ + "p_model_model_language_model_layers_22_linear_attn_a_log" + ], + "output": "exp_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_27", + "inputs": [ + "exp_17" + ], + "output": "neg_27", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_237", + "inputs": [ + "linear_174", + "p_model_model_language_model_layers_22_linear_attn_dt_bias" + ], + "output": "add_237", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/77f9becbd500abcaf6a8d278cbcb6c7031868ff5bf74f41284940d56894cf9fa.wgsl" + }, + { + "node": "softplus_17", + "inputs": [ + "add_237" + ], + "output": "softplus_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl" + }, + { + "node": "mul_300", + "inputs": [ + "neg_27", + "softplus_17" + ], + "output": "mul_300", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/f66b0b2ea4229895bb6599fb5d3528be17eb9020c19829b54dd0fbb4d4857039.wgsl" + }, + { + "node": "mul_301", + "inputs": [ + "view_145" + ], + "output": "mul_301", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_35", + "inputs": [ + "mul_301" + ], + "output": "sum_35", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_238", + "inputs": [ + "sum_35" + ], + "output": "add_238", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_106", + "inputs": [ + "add_238" + ], + "output": "rsqrt_106", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_302", + "inputs": [ + "view_145", + "rsqrt_106" + ], + "output": "mul_302", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "mul_303", + "inputs": [ + "view_146" + ], + "output": "mul_303", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/f45156a1c571e56cf0730c88fcd58dbb5716b2cea086ebb9e0dfedfe5dcbf658.wgsl" + }, + { + "node": "sum_36", + "inputs": [ + "mul_303" + ], + "output": "sum_36", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c1096000361a304457865401d6266a640469ca04c0bbfe2eaa657e656b2fca33.wgsl" + }, + { + "node": "add_239", + "inputs": [ + "sum_36" + ], + "output": "add_239", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/4a4eb52af727f11dfbd69b294a8ab3eb5053bd5a2feea3cfdb35ab10bc1a4426.wgsl" + }, + { + "node": "rsqrt_107", + "inputs": [ + "add_239" + ], + "output": "rsqrt_107", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/de4b2b6e4d6c225d58c25261df5c8f73711c3bbbd04a31d1ea5c5bffc827c6e9.wgsl" + }, + { + "node": "mul_304", + "inputs": [ + "view_146", + "rsqrt_107" + ], + "output": "mul_304", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/c3735f34cafbac42efa5928641cefdaf7277659cc2675a36756bba97240ba5ae.wgsl" + }, + { + "node": "normalized_gated_delta_rule_17", + "inputs": [ + "mul_302", + "mul_304", + "view_147", + "mul_300", + "sigmoid_22", + "states_45" + ], + "output": "normalized_gated_delta_rule_17", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl" + }, + { + "node": "slice_202", + "inputs": [ + "normalized_gated_delta_rule_17" + ], + "output": "slice_202", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_45", + "kernel": "kernels/3087f59456d6581e7cdad1a14086af53281e39d2041a6a93387ba6e1daf5f9cb.wgsl" + }, + { + "node": "slice_203", + "inputs": [ + "normalized_gated_delta_rule_17" + ], + "output": "slice_203", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/e91fae5817b3b5e4b0025d4fa70d4cfa10b010d038a3f45c6348d25379df287d.wgsl" + }, + { + "node": "transpose_91", + "inputs": [ + "slice_203" + ], + "output": "transpose_91", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/fa7c163b443e5f494b83f24da518fcad3e353d6e85facc3e3478f6005f964bd6.wgsl" + }, + { + "node": "clone_37", + "inputs": [ + "transpose_91" + ], + "output": "clone_37", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_148", + "inputs": [ + "clone_37" + ], + "output": "view_148", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_149", + "inputs": [ + "view_144" + ], + "output": "view_149", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_306", + "inputs": [ + "view_148", + "p_model_model_language_model_layers_22_linear_attn_norm_weight" + ], + "output": "mul_306", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/564b62d37d6845f8049f903d4ba35762c607937d8a9644bfe511fbc7bf90dacd.wgsl" + }, + { + "node": "mul_307", + "inputs": [ + "view_149", + "mul_306" + ], + "output": "mul_307", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/870f571c2825eaa5aa7203a42631ed44e533c50f236974cb4591aa3c73b231a6.wgsl" + }, + { + "node": "view_150", + "inputs": [ + "mul_307" + ], + "output": "view_150", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_175", + "inputs": [ + "view_150", + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight" + ], + "output": "linear_175", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_241", + "inputs": [ + "add_234", + "linear_175" + ], + "output": "add_241", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_309", + "inputs": [ + "add_241", + "p_model_model_language_model_layers_22_post_attention_layernorm_weight" + ], + "output": "mul_309", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_55", + "inputs": [ + "mul_309" + ], + "output": "type_as_55", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_176", + "inputs": [ + "type_as_55", + "p_model_model_language_model_layers_22_mlp_gate_proj_weight" + ], + "output": "linear_176", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_177", + "inputs": [ + "type_as_55", + "p_model_model_language_model_layers_22_mlp_up_proj_weight" + ], + "output": "linear_177", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_310", + "inputs": [ + "linear_176", + "linear_177" + ], + "output": "mul_310", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_178", + "inputs": [ + "mul_310", + "p_model_model_language_model_layers_22_mlp_down_proj_weight" + ], + "output": "linear_178", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_244", + "inputs": [ + "add_241", + "linear_178" + ], + "output": "add_244", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_312", + "inputs": [ + "add_244", + "p_model_model_language_model_layers_23_input_layernorm_weight" + ], + "output": "mul_312", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_56", + "inputs": [ + "mul_312" + ], + "output": "type_as_56", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_179", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_q_proj_weight" + ], + "output": "linear_179", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/809edbbbbbd45df1163aca9506775b9c2ae0d51f65a31a5396599cfeeb7009fc.wgsl" + }, + { + "node": "view_151", + "inputs": [ + "linear_179" + ], + "output": "view_151", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/ef9aa0463882f8482e3a4e9ee97d5101a06c94645292cfdcf2deeff81ee4a284.wgsl" + }, + { + "node": "slice_204", + "inputs": [ + "view_151" + ], + "output": "slice_204", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2eeb54034621ff097879064a60fd4e0dd5d68201e48296ad234413a39579acc8.wgsl" + }, + { + "node": "slice_205", + "inputs": [ + "view_151" + ], + "output": "slice_205", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl" + }, + { + "node": "clone_38", + "inputs": [ + "slice_205" + ], + "output": "clone_38", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "_unsafe_view_15", + "inputs": [ + "clone_38" + ], + "output": "_unsafe_view_15", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_152", + "inputs": [ + "slice_204" + ], + "output": "view_152", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "mul_314", + "inputs": [ + "view_152", + "p_model_model_language_model_layers_23_self_attn_q_norm_weight" + ], + "output": "mul_314", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/246ea07912fcd8a9073926e863141111eb4091b52cc980a6eef148beed122fc4.wgsl" + }, + { + "node": "type_as_57", + "inputs": [ + "mul_314" + ], + "output": "type_as_57", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "transpose_92", + "inputs": [ + "type_as_57" + ], + "output": "transpose_92", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl" + }, + { + "node": "linear_180", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_k_proj_weight" + ], + "output": "linear_180", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_153", + "inputs": [ + "linear_180" + ], + "output": "view_153", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "mul_316", + "inputs": [ + "view_153", + "p_model_model_language_model_layers_23_self_attn_k_norm_weight" + ], + "output": "mul_316", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f994142054bcb47d6a554524dd8de9c3054467a1d07011027c47f475d0909c19.wgsl" + }, + { + "node": "type_as_58", + "inputs": [ + "mul_316" + ], + "output": "type_as_58", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_93", + "inputs": [ + "type_as_58" + ], + "output": "transpose_93", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "linear_181", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_v_proj_weight" + ], + "output": "linear_181", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/262399e4b2661342c29fddf17556e93608f7aead68939859c29fcc594f455f69.wgsl" + }, + { + "node": "view_154", + "inputs": [ + "linear_181" + ], + "output": "view_154", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/7fe183583b43b627721ba6853b306288d7ceea4b42b630410f47ea9637220a4b.wgsl" + }, + { + "node": "transpose_94", + "inputs": [ + "view_154" + ], + "output": "transpose_94", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/67816e11d408a6230572433502ace2f9a337285eb623360a1cec493e95add139.wgsl" + }, + { + "node": "unsqueeze_42", + "inputs": [ + "mul" + ], + "output": "unsqueeze_42", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "unsqueeze_43", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_43", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/94a128c4e3d052323e995364319a5607fe0514a04b040a13cfffd1b11c445775.wgsl" + }, + { + "node": "slice_206", + "inputs": [ + "transpose_92" + ], + "output": "slice_206", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8b5e4c9b7889f2bccebf60987b6f5b8c23542c3475cd8d78656dc7ecffd81f8d.wgsl" + }, + { + "node": "slice_207", + "inputs": [ + "transpose_92" + ], + "output": "slice_207", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/f95724b4a3d2dbafaccd23a45f68234bb49e4a39168942060ca628960993f33d.wgsl" + }, + { + "node": "slice_208", + "inputs": [ + "transpose_93" + ], + "output": "slice_208", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/ad72f60d58133272228319f1c066e7cd43ac28573ddeeb7a6f69be01af341f57.wgsl" + }, + { + "node": "slice_209", + "inputs": [ + "transpose_93" + ], + "output": "slice_209", + "workgroups": [ + 24, + 1, + 1 + ], + "kernel": "kernels/8af32f59dfb78c79ac2187ae707f0897b89fb8bb0e3d832e2edac308eefa603c.wgsl" + }, + { + "node": "mul_317", + "inputs": [ + "slice_206", + "unsqueeze_42" + ], + "output": "mul_317", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "slice_210", + "inputs": [ + "slice_206" + ], + "output": "slice_210", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/8ee286e06c1271162bea74e14b4bd5b1d66890648217c79435e6b3f1d4181ec8.wgsl" + }, + { + "node": "slice_211", + "inputs": [ + "slice_206" + ], + "output": "slice_211", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/80d22263b082805bc9d4499247f92b7a1a783a3e1cdd9c652d304492a1cfd425.wgsl" + }, + { + "node": "neg_28", + "inputs": [ + "slice_211" + ], + "output": "neg_28", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl" + }, + { + "node": "cat_39", + "inputs": [ + "neg_28", + "slice_210" + ], + "output": "cat_39", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/bda7ebd3bcf25c31938fca1a582e82b972ab742f85f826f085417b0e6f651e60.wgsl" + }, + { + "node": "mul_318", + "inputs": [ + "cat_39", + "unsqueeze_43" + ], + "output": "mul_318", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/40f115c8647a238bfb3ccb0bb8446bccdc94a0dfadc89111c4920efb2259f41d.wgsl" + }, + { + "node": "add_251", + "inputs": [ + "mul_317", + "mul_318" + ], + "output": "add_251", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl" + }, + { + "node": "mul_319", + "inputs": [ + "slice_208", + "unsqueeze_42" + ], + "output": "mul_319", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "slice_212", + "inputs": [ + "slice_208" + ], + "output": "slice_212", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/8c3a77238461b0ae13318bad504e1e0779f3f47d1782fe0ca78f20112c031146.wgsl" + }, + { + "node": "slice_213", + "inputs": [ + "slice_208" + ], + "output": "slice_213", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/b2ae1b161c8a6315f8863e47511607027dfe583aac1db4c1626371ddfa0c64e2.wgsl" + }, + { + "node": "neg_29", + "inputs": [ + "slice_213" + ], + "output": "neg_29", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/4fad29e3e337840e25132f10b3e3d55225f727ae13525ff0b0bdf31e03f09d74.wgsl" + }, + { + "node": "cat_40", + "inputs": [ + "neg_29", + "slice_212" + ], + "output": "cat_40", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/898086c99e03b2cdb78e3e5658c3fff202f1c87d09d8da08659bd1ba85e01b09.wgsl" + }, + { + "node": "mul_320", + "inputs": [ + "cat_40", + "unsqueeze_43" + ], + "output": "mul_320", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/d0be84d22b9e3b0cf73729e9a6fad1c6cf7d03fa01b45b8765ed70158578f2a9.wgsl" + }, + { + "node": "add_252", + "inputs": [ + "mul_319", + "mul_320" + ], + "output": "add_252", + "workgroups": [ + 8, + 1, + 1 + ], + "kernel": "kernels/f5b51b1e0e52bd87a70a0ca169186ebb5734cbdc2b8f375ba0241485b1df4e66.wgsl" + }, + { + "node": "cat_41", + "inputs": [ + "add_251", + "slice_207" + ], + "output": "cat_41", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/97aa9b5cb2a41dbf920a6c15c61964d33dd0d87990a00183ac4b87c614bc376d.wgsl" + }, + { + "node": "cat_42", + "inputs": [ + "add_252", + "slice_209" + ], + "output": "cat_42", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f276cf6656b999339df464b61934487f5c8eb7a0957cf6d902254ab1aa2ffcd0.wgsl" + }, + { + "node": "cache_update_10", + "inputs": [ + "cat_42", + "cache_position" + ], + "output": "cache_update_10", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_46", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "cache_update_11", + "inputs": [ + "transpose_94", + "cache_position" + ], + "output": "cache_update_11", + "workgroups": [ + 32, + 1, + 1 + ], + "inPlaceOf": "states_47", + "kernel": "kernels/939eb5e3ec5862e0f1d8caec99b814ed6b2bb3a41a132f7149a503e8df582e3c.wgsl" + }, + { + "node": "unsqueeze_44", + "inputs": [ + "cache_update_10" + ], + "output": "unsqueeze_44", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_11", + "inputs": [ + "unsqueeze_44" + ], + "output": "expand_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_39", + "inputs": [ + "expand_11" + ], + "output": "clone_39", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_16", + "inputs": [ + "clone_39" + ], + "output": "_unsafe_view_16", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_45", + "inputs": [ + "cache_update_11" + ], + "output": "unsqueeze_45", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_12", + "inputs": [ + "unsqueeze_45" + ], + "output": "expand_12", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_40", + "inputs": [ + "expand_12" + ], + "output": "clone_40", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_17", + "inputs": [ + "clone_40" + ], + "output": "_unsafe_view_17", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_95", + "inputs": [ + "_unsafe_view_16" + ], + "output": "transpose_95", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_11", + "inputs": [ + "cat_41", + "transpose_95" + ], + "output": "matmul_11", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8d3901ffa1bf261d953e73b6ee49a0cb486607d014576f319054a30b2a878d16.wgsl" + }, + { + "node": "mul_321", + "inputs": [ + "matmul_11" + ], + "output": "mul_321", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/87a0173f6b11329ec1cabdb66aac50298a6f8466a8608cdf60ec6dfb19791b46.wgsl" + }, + { + "node": "add_253", + "inputs": [ + "mul_321", + "attention_mask" + ], + "output": "add_253", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2622c3df557e0d2b8c61c86cb748cfcf7970ebce8750a37ef611b8cabdd152d6.wgsl" + }, + { + "node": "softmax_5", + "inputs": [ + "add_253" + ], + "output": "softmax_5", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/8f49f6b8f8a2ee074b9fb925c2ea40d1f3b8af945a801b677a197a98e37fc26d.wgsl" + }, + { + "node": "matmul_12", + "inputs": [ + "softmax_5", + "_unsafe_view_17" + ], + "output": "matmul_12", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/60a9a411c756055d21d8ec478436ba82e0fd522ccf1eb4488aef6b25769d96c5.wgsl" + }, + { + "node": "transpose_96", + "inputs": [ + "matmul_12" + ], + "output": "transpose_96", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/2792ae5841828bd5af938c10096abe385e63bb3ec2a22e850f146739433c12bf.wgsl" + }, + { + "node": "clone_41", + "inputs": [ + "transpose_96" + ], + "output": "clone_41", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "view_155", + "inputs": [ + "clone_41" + ], + "output": "view_155", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "sigmoid_23", + "inputs": [ + "_unsafe_view_15" + ], + "output": "sigmoid_23", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/a53c1ce51ebaec593ad667efae9603efe3807db8f0ee060a620ac031cc4f2b92.wgsl" + }, + { + "node": "mul_322", + "inputs": [ + "view_155", + "sigmoid_23" + ], + "output": "mul_322", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/45a1fd3ed514f208718651026bf2ee30dda66b02cdd950dc71e88eb6bdac0b10.wgsl" + }, + { + "node": "linear_182", + "inputs": [ + "mul_322", + "p_model_model_language_model_layers_23_self_attn_o_proj_weight" + ], + "output": "linear_182", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/a4803f845cab5f8bb5c34e5f6686e55705cc0dfd573472c6bc83190d2621296a.wgsl" + }, + { + "node": "add_254", + "inputs": [ + "add_244", + "linear_182" + ], + "output": "add_254", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_324", + "inputs": [ + "add_254", + "p_model_model_language_model_layers_23_post_attention_layernorm_weight" + ], + "output": "mul_324", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_59", + "inputs": [ + "mul_324" + ], + "output": "type_as_59", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_183", + "inputs": [ + "type_as_59", + "p_model_model_language_model_layers_23_mlp_gate_proj_weight" + ], + "output": "linear_183", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "linear_184", + "inputs": [ + "type_as_59", + "p_model_model_language_model_layers_23_mlp_up_proj_weight" + ], + "output": "linear_184", + "workgroups": [ + 768, + 1, + 1 + ], + "kernel": "kernels/43202a5f42d7ade5add5ebd7fa104b08e012c42739fe21cdb9480813afbb12f0.wgsl" + }, + { + "node": "mul_325", + "inputs": [ + "linear_183", + "linear_184" + ], + "output": "mul_325", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/3d5b97cfaf8dd0e680b6a9c84e7eca497f9f6e49817d20f1a72dddd7a3303f73.wgsl" + }, + { + "node": "linear_185", + "inputs": [ + "mul_325", + "p_model_model_language_model_layers_23_mlp_down_proj_weight" + ], + "output": "linear_185", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl" + }, + { + "node": "add_257", + "inputs": [ + "add_254", + "linear_185" + ], + "output": "add_257", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "mul_327", + "inputs": [ + "add_257", + "p_model_model_language_model_norm_weight" + ], + "output": "mul_327", + "workgroups": [ + 4, + 1, + 1 + ], + "kernel": "kernels/bc3debb5b2d1630349d983f26929555c7a91b4c38435f2c464c6c66a52b9c566.wgsl" + }, + { + "node": "type_as_60", + "inputs": [ + "mul_327" + ], + "output": "type_as_60", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "alias", + "inputs": [ + "type_as_60" + ], + "output": "alias", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/b28ea4a8345a9c9abb2d74bfd620ba5de46616434dbaffdbabf022ea71800839.wgsl" + }, + { + "node": "linear_186__part_0", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_0_32768" + ], + "output": "linear_186__part_0", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_1", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768" + ], + "output": "linear_186__part_1", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_2", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768" + ], + "output": "linear_186__part_2", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_3", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768" + ], + "output": "linear_186__part_3", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_4", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768" + ], + "output": "linear_186__part_4", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_5", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768" + ], + "output": "linear_186__part_5", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_6", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768" + ], + "output": "linear_186__part_6", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/52d5f0189ff49849070362fea5585100e0c7a9eb6ff6722e3b545c113b965292.wgsl" + }, + { + "node": "linear_186__part_7", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944" + ], + "output": "linear_186__part_7", + "workgroups": [ + 2368, + 1, + 1 + ], + "kernel": "kernels/9a9c990c9717c93933b1e7f5204d99a16276a177b7ca2f8c8cf61dbc1f6aaf51.wgsl" + }, + { + "node": "linear_186__cat_0_0", + "inputs": [ + "linear_186__part_0", + "linear_186__part_1", + "linear_186__part_2", + "linear_186__part_3", + "linear_186__part_4", + "linear_186__part_5", + "linear_186__part_6" + ], + "output": "linear_186__cat_0_0", + "workgroups": [ + 14336, + 1, + 1 + ], + "kernel": "kernels/5b657fa4e308a89ca0d0edb8cb2a485d6f048dcdbcffb9e2c3a50073be7ad3ff.wgsl" + }, + { + "node": "linear_186__cat_0_7", + "inputs": [ + "linear_186__part_7" + ], + "output": "linear_186__cat_0_7", + "workgroups": [ + 1184, + 1, + 1 + ], + "kernel": "kernels/c8c077eea97ee78f1f10dacccd47d60cd76278ea99d0863ce3ca8f16601785bd.wgsl" + }, + { + "node": "linear_186", + "inputs": [ + "linear_186__cat_0_0", + "linear_186__cat_0_7" + ], + "output": "linear_186", + "workgroups": [ + 15520, + 1, + 1 + ], + "kernel": "kernels/087fe4a47ab2de93b999a0e519015c12450bf97fb81683d317c894b2bd555169.wgsl" + } + ], + "memory": { + "slots": [ + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 128, + 16, + 64, + 65536, + 32768, + 16, + 16, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 77594624, + 32768, + 32768, + 32768, + 32768, + 32768, + 32768, + 32768, + 32768, + 32768, + 98304, + 98304, + 196608, + 270336, + 1081344, + 4096, + 4096, + 8192, + 8388608, + 33554432, + 33554432, + 33554432, + 524288, + 524288, + 303104, + 3670016 + ], + "assignment": { + "p_model_model_language_model_layers_0_input_layernorm_weight": 0, + "p_model_model_language_model_layers_0_linear_attn_a_log": 1, + "p_model_model_language_model_layers_0_linear_attn_dt_bias": 2, + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight": 3, + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight": 4, + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight": 5, + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight": 6, + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight": 7, + "p_model_model_language_model_layers_0_linear_attn_norm_weight": 8, + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight": 9, + "p_model_model_language_model_layers_0_post_attention_layernorm_weight": 10, + "p_model_model_language_model_layers_0_mlp_gate_proj_weight": 11, + "p_model_model_language_model_layers_0_mlp_up_proj_weight": 12, + "p_model_model_language_model_layers_0_mlp_down_proj_weight": 13, + "p_model_model_language_model_layers_1_input_layernorm_weight": 14, + "p_model_model_language_model_layers_1_linear_attn_a_log": 15, + "p_model_model_language_model_layers_1_linear_attn_dt_bias": 16, + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight": 17, + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight": 18, + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight": 19, + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight": 20, + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight": 21, + "p_model_model_language_model_layers_1_linear_attn_norm_weight": 22, + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight": 23, + "p_model_model_language_model_layers_1_post_attention_layernorm_weight": 24, + "p_model_model_language_model_layers_1_mlp_gate_proj_weight": 25, + "p_model_model_language_model_layers_1_mlp_up_proj_weight": 26, + "p_model_model_language_model_layers_1_mlp_down_proj_weight": 27, + "p_model_model_language_model_layers_2_input_layernorm_weight": 28, + "p_model_model_language_model_layers_2_linear_attn_a_log": 29, + "p_model_model_language_model_layers_2_linear_attn_dt_bias": 30, + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight": 31, + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight": 32, + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight": 33, + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight": 34, + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight": 35, + "p_model_model_language_model_layers_2_linear_attn_norm_weight": 36, + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight": 37, + "p_model_model_language_model_layers_2_post_attention_layernorm_weight": 38, + "p_model_model_language_model_layers_2_mlp_gate_proj_weight": 39, + "p_model_model_language_model_layers_2_mlp_up_proj_weight": 40, + "p_model_model_language_model_layers_2_mlp_down_proj_weight": 41, + "p_model_model_language_model_layers_3_input_layernorm_weight": 42, + "p_model_model_language_model_layers_3_self_attn_q_proj_weight": 43, + "p_model_model_language_model_layers_3_self_attn_q_norm_weight": 44, + "p_model_model_language_model_layers_3_self_attn_k_proj_weight": 45, + "p_model_model_language_model_layers_3_self_attn_k_norm_weight": 46, + "p_model_model_language_model_layers_3_self_attn_v_proj_weight": 47, + "p_model_model_language_model_layers_3_self_attn_o_proj_weight": 48, + "p_model_model_language_model_layers_3_post_attention_layernorm_weight": 49, + "p_model_model_language_model_layers_3_mlp_gate_proj_weight": 50, + "p_model_model_language_model_layers_3_mlp_up_proj_weight": 51, + "p_model_model_language_model_layers_3_mlp_down_proj_weight": 52, + "p_model_model_language_model_layers_4_input_layernorm_weight": 53, + "p_model_model_language_model_layers_4_linear_attn_a_log": 54, + "p_model_model_language_model_layers_4_linear_attn_dt_bias": 55, + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight": 56, + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight": 57, + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight": 58, + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight": 59, + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight": 60, + "p_model_model_language_model_layers_4_linear_attn_norm_weight": 61, + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight": 62, + "p_model_model_language_model_layers_4_post_attention_layernorm_weight": 63, + "p_model_model_language_model_layers_4_mlp_gate_proj_weight": 64, + "p_model_model_language_model_layers_4_mlp_up_proj_weight": 65, + "p_model_model_language_model_layers_4_mlp_down_proj_weight": 66, + "p_model_model_language_model_layers_5_input_layernorm_weight": 67, + "p_model_model_language_model_layers_5_linear_attn_a_log": 68, + "p_model_model_language_model_layers_5_linear_attn_dt_bias": 69, + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight": 70, + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight": 71, + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight": 72, + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight": 73, + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight": 74, + "p_model_model_language_model_layers_5_linear_attn_norm_weight": 75, + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight": 76, + "p_model_model_language_model_layers_5_post_attention_layernorm_weight": 77, + "p_model_model_language_model_layers_5_mlp_gate_proj_weight": 78, + "p_model_model_language_model_layers_5_mlp_up_proj_weight": 79, + "p_model_model_language_model_layers_5_mlp_down_proj_weight": 80, + "p_model_model_language_model_layers_6_input_layernorm_weight": 81, + "p_model_model_language_model_layers_6_linear_attn_a_log": 82, + "p_model_model_language_model_layers_6_linear_attn_dt_bias": 83, + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight": 84, + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight": 85, + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight": 86, + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight": 87, + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight": 88, + "p_model_model_language_model_layers_6_linear_attn_norm_weight": 89, + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight": 90, + "p_model_model_language_model_layers_6_post_attention_layernorm_weight": 91, + "p_model_model_language_model_layers_6_mlp_gate_proj_weight": 92, + "p_model_model_language_model_layers_6_mlp_up_proj_weight": 93, + "p_model_model_language_model_layers_6_mlp_down_proj_weight": 94, + "p_model_model_language_model_layers_7_input_layernorm_weight": 95, + "p_model_model_language_model_layers_7_self_attn_q_proj_weight": 96, + "p_model_model_language_model_layers_7_self_attn_q_norm_weight": 97, + "p_model_model_language_model_layers_7_self_attn_k_proj_weight": 98, + "p_model_model_language_model_layers_7_self_attn_k_norm_weight": 99, + "p_model_model_language_model_layers_7_self_attn_v_proj_weight": 100, + "p_model_model_language_model_layers_7_self_attn_o_proj_weight": 101, + "p_model_model_language_model_layers_7_post_attention_layernorm_weight": 102, + "p_model_model_language_model_layers_7_mlp_gate_proj_weight": 103, + "p_model_model_language_model_layers_7_mlp_up_proj_weight": 104, + "p_model_model_language_model_layers_7_mlp_down_proj_weight": 105, + "p_model_model_language_model_layers_8_input_layernorm_weight": 106, + "p_model_model_language_model_layers_8_linear_attn_a_log": 107, + "p_model_model_language_model_layers_8_linear_attn_dt_bias": 108, + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight": 109, + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight": 110, + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight": 111, + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight": 112, + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight": 113, + "p_model_model_language_model_layers_8_linear_attn_norm_weight": 114, + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight": 115, + "p_model_model_language_model_layers_8_post_attention_layernorm_weight": 116, + "p_model_model_language_model_layers_8_mlp_gate_proj_weight": 117, + "p_model_model_language_model_layers_8_mlp_up_proj_weight": 118, + "p_model_model_language_model_layers_8_mlp_down_proj_weight": 119, + "p_model_model_language_model_layers_9_input_layernorm_weight": 120, + "p_model_model_language_model_layers_9_linear_attn_a_log": 121, + "p_model_model_language_model_layers_9_linear_attn_dt_bias": 122, + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight": 123, + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight": 124, + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight": 125, + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight": 126, + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight": 127, + "p_model_model_language_model_layers_9_linear_attn_norm_weight": 128, + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight": 129, + "p_model_model_language_model_layers_9_post_attention_layernorm_weight": 130, + "p_model_model_language_model_layers_9_mlp_gate_proj_weight": 131, + "p_model_model_language_model_layers_9_mlp_up_proj_weight": 132, + "p_model_model_language_model_layers_9_mlp_down_proj_weight": 133, + "p_model_model_language_model_layers_10_input_layernorm_weight": 134, + "p_model_model_language_model_layers_10_linear_attn_a_log": 135, + "p_model_model_language_model_layers_10_linear_attn_dt_bias": 136, + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight": 137, + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight": 138, + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight": 139, + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight": 140, + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight": 141, + "p_model_model_language_model_layers_10_linear_attn_norm_weight": 142, + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight": 143, + "p_model_model_language_model_layers_10_post_attention_layernorm_weight": 144, + "p_model_model_language_model_layers_10_mlp_gate_proj_weight": 145, + "p_model_model_language_model_layers_10_mlp_up_proj_weight": 146, + "p_model_model_language_model_layers_10_mlp_down_proj_weight": 147, + "p_model_model_language_model_layers_11_input_layernorm_weight": 148, + "p_model_model_language_model_layers_11_self_attn_q_proj_weight": 149, + "p_model_model_language_model_layers_11_self_attn_q_norm_weight": 150, + "p_model_model_language_model_layers_11_self_attn_k_proj_weight": 151, + "p_model_model_language_model_layers_11_self_attn_k_norm_weight": 152, + "p_model_model_language_model_layers_11_self_attn_v_proj_weight": 153, + "p_model_model_language_model_layers_11_self_attn_o_proj_weight": 154, + "p_model_model_language_model_layers_11_post_attention_layernorm_weight": 155, + "p_model_model_language_model_layers_11_mlp_gate_proj_weight": 156, + "p_model_model_language_model_layers_11_mlp_up_proj_weight": 157, + "p_model_model_language_model_layers_11_mlp_down_proj_weight": 158, + "p_model_model_language_model_layers_12_input_layernorm_weight": 159, + "p_model_model_language_model_layers_12_linear_attn_a_log": 160, + "p_model_model_language_model_layers_12_linear_attn_dt_bias": 161, + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight": 162, + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight": 163, + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight": 164, + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight": 165, + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight": 166, + "p_model_model_language_model_layers_12_linear_attn_norm_weight": 167, + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight": 168, + "p_model_model_language_model_layers_12_post_attention_layernorm_weight": 169, + "p_model_model_language_model_layers_12_mlp_gate_proj_weight": 170, + "p_model_model_language_model_layers_12_mlp_up_proj_weight": 171, + "p_model_model_language_model_layers_12_mlp_down_proj_weight": 172, + "p_model_model_language_model_layers_13_input_layernorm_weight": 173, + "p_model_model_language_model_layers_13_linear_attn_a_log": 174, + "p_model_model_language_model_layers_13_linear_attn_dt_bias": 175, + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight": 176, + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight": 177, + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight": 178, + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight": 179, + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight": 180, + "p_model_model_language_model_layers_13_linear_attn_norm_weight": 181, + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight": 182, + "p_model_model_language_model_layers_13_post_attention_layernorm_weight": 183, + "p_model_model_language_model_layers_13_mlp_gate_proj_weight": 184, + "p_model_model_language_model_layers_13_mlp_up_proj_weight": 185, + "p_model_model_language_model_layers_13_mlp_down_proj_weight": 186, + "p_model_model_language_model_layers_14_input_layernorm_weight": 187, + "p_model_model_language_model_layers_14_linear_attn_a_log": 188, + "p_model_model_language_model_layers_14_linear_attn_dt_bias": 189, + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight": 190, + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight": 191, + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight": 192, + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight": 193, + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight": 194, + "p_model_model_language_model_layers_14_linear_attn_norm_weight": 195, + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight": 196, + "p_model_model_language_model_layers_14_post_attention_layernorm_weight": 197, + "p_model_model_language_model_layers_14_mlp_gate_proj_weight": 198, + "p_model_model_language_model_layers_14_mlp_up_proj_weight": 199, + "p_model_model_language_model_layers_14_mlp_down_proj_weight": 200, + "p_model_model_language_model_layers_15_input_layernorm_weight": 201, + "p_model_model_language_model_layers_15_self_attn_q_proj_weight": 202, + "p_model_model_language_model_layers_15_self_attn_q_norm_weight": 203, + "p_model_model_language_model_layers_15_self_attn_k_proj_weight": 204, + "p_model_model_language_model_layers_15_self_attn_k_norm_weight": 205, + "p_model_model_language_model_layers_15_self_attn_v_proj_weight": 206, + "p_model_model_language_model_layers_15_self_attn_o_proj_weight": 207, + "p_model_model_language_model_layers_15_post_attention_layernorm_weight": 208, + "p_model_model_language_model_layers_15_mlp_gate_proj_weight": 209, + "p_model_model_language_model_layers_15_mlp_up_proj_weight": 210, + "p_model_model_language_model_layers_15_mlp_down_proj_weight": 211, + "p_model_model_language_model_layers_16_input_layernorm_weight": 212, + "p_model_model_language_model_layers_16_linear_attn_a_log": 213, + "p_model_model_language_model_layers_16_linear_attn_dt_bias": 214, + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight": 215, + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight": 216, + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight": 217, + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight": 218, + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight": 219, + "p_model_model_language_model_layers_16_linear_attn_norm_weight": 220, + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight": 221, + "p_model_model_language_model_layers_16_post_attention_layernorm_weight": 222, + "p_model_model_language_model_layers_16_mlp_gate_proj_weight": 223, + "p_model_model_language_model_layers_16_mlp_up_proj_weight": 224, + "p_model_model_language_model_layers_16_mlp_down_proj_weight": 225, + "p_model_model_language_model_layers_17_input_layernorm_weight": 226, + "p_model_model_language_model_layers_17_linear_attn_a_log": 227, + "p_model_model_language_model_layers_17_linear_attn_dt_bias": 228, + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight": 229, + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight": 230, + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight": 231, + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight": 232, + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight": 233, + "p_model_model_language_model_layers_17_linear_attn_norm_weight": 234, + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight": 235, + "p_model_model_language_model_layers_17_post_attention_layernorm_weight": 236, + "p_model_model_language_model_layers_17_mlp_gate_proj_weight": 237, + "p_model_model_language_model_layers_17_mlp_up_proj_weight": 238, + "p_model_model_language_model_layers_17_mlp_down_proj_weight": 239, + "p_model_model_language_model_layers_18_input_layernorm_weight": 240, + "p_model_model_language_model_layers_18_linear_attn_a_log": 241, + "p_model_model_language_model_layers_18_linear_attn_dt_bias": 242, + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight": 243, + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight": 244, + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight": 245, + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight": 246, + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight": 247, + "p_model_model_language_model_layers_18_linear_attn_norm_weight": 248, + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight": 249, + "p_model_model_language_model_layers_18_post_attention_layernorm_weight": 250, + "p_model_model_language_model_layers_18_mlp_gate_proj_weight": 251, + "p_model_model_language_model_layers_18_mlp_up_proj_weight": 252, + "p_model_model_language_model_layers_18_mlp_down_proj_weight": 253, + "p_model_model_language_model_layers_19_input_layernorm_weight": 254, + "p_model_model_language_model_layers_19_self_attn_q_proj_weight": 255, + "p_model_model_language_model_layers_19_self_attn_q_norm_weight": 256, + "p_model_model_language_model_layers_19_self_attn_k_proj_weight": 257, + "p_model_model_language_model_layers_19_self_attn_k_norm_weight": 258, + "p_model_model_language_model_layers_19_self_attn_v_proj_weight": 259, + "p_model_model_language_model_layers_19_self_attn_o_proj_weight": 260, + "p_model_model_language_model_layers_19_post_attention_layernorm_weight": 261, + "p_model_model_language_model_layers_19_mlp_gate_proj_weight": 262, + "p_model_model_language_model_layers_19_mlp_up_proj_weight": 263, + "p_model_model_language_model_layers_19_mlp_down_proj_weight": 264, + "p_model_model_language_model_layers_20_input_layernorm_weight": 265, + "p_model_model_language_model_layers_20_linear_attn_a_log": 266, + "p_model_model_language_model_layers_20_linear_attn_dt_bias": 267, + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight": 268, + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight": 269, + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight": 270, + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight": 271, + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight": 272, + "p_model_model_language_model_layers_20_linear_attn_norm_weight": 273, + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight": 274, + "p_model_model_language_model_layers_20_post_attention_layernorm_weight": 275, + "p_model_model_language_model_layers_20_mlp_gate_proj_weight": 276, + "p_model_model_language_model_layers_20_mlp_up_proj_weight": 277, + "p_model_model_language_model_layers_20_mlp_down_proj_weight": 278, + "p_model_model_language_model_layers_21_input_layernorm_weight": 279, + "p_model_model_language_model_layers_21_linear_attn_a_log": 280, + "p_model_model_language_model_layers_21_linear_attn_dt_bias": 281, + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight": 282, + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight": 283, + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight": 284, + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight": 285, + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight": 286, + "p_model_model_language_model_layers_21_linear_attn_norm_weight": 287, + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight": 288, + "p_model_model_language_model_layers_21_post_attention_layernorm_weight": 289, + "p_model_model_language_model_layers_21_mlp_gate_proj_weight": 290, + "p_model_model_language_model_layers_21_mlp_up_proj_weight": 291, + "p_model_model_language_model_layers_21_mlp_down_proj_weight": 292, + "p_model_model_language_model_layers_22_input_layernorm_weight": 293, + "p_model_model_language_model_layers_22_linear_attn_a_log": 294, + "p_model_model_language_model_layers_22_linear_attn_dt_bias": 295, + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight": 296, + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight": 297, + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight": 298, + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight": 299, + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight": 300, + "p_model_model_language_model_layers_22_linear_attn_norm_weight": 301, + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight": 302, + "p_model_model_language_model_layers_22_post_attention_layernorm_weight": 303, + "p_model_model_language_model_layers_22_mlp_gate_proj_weight": 304, + "p_model_model_language_model_layers_22_mlp_up_proj_weight": 305, + "p_model_model_language_model_layers_22_mlp_down_proj_weight": 306, + "p_model_model_language_model_layers_23_input_layernorm_weight": 307, + "p_model_model_language_model_layers_23_self_attn_q_proj_weight": 308, + "p_model_model_language_model_layers_23_self_attn_q_norm_weight": 309, + "p_model_model_language_model_layers_23_self_attn_k_proj_weight": 310, + "p_model_model_language_model_layers_23_self_attn_k_norm_weight": 311, + "p_model_model_language_model_layers_23_self_attn_v_proj_weight": 312, + "p_model_model_language_model_layers_23_self_attn_o_proj_weight": 313, + "p_model_model_language_model_layers_23_post_attention_layernorm_weight": 314, + "p_model_model_language_model_layers_23_mlp_gate_proj_weight": 315, + "p_model_model_language_model_layers_23_mlp_up_proj_weight": 316, + "p_model_model_language_model_layers_23_mlp_down_proj_weight": 317, + "p_model_model_language_model_norm_weight": 318, + "b_model_model_language_model_rotary_emb_inv_freq": 319, + "input_ids": 320, + "position_ids": 321, + "attention_mask": 322, + "image_embedding": 323, + "is_image": 324, + "cache_position": 325, + "states_0": 326, + "states_1": 327, + "states_2": 328, + "states_3": 329, + "states_4": 330, + "states_5": 331, + "states_6": 332, + "states_7": 333, + "states_8": 334, + "states_9": 335, + "states_10": 336, + "states_11": 337, + "states_12": 338, + "states_13": 339, + "states_14": 340, + "states_15": 341, + "states_16": 342, + "states_17": 343, + "states_18": 344, + "states_19": 345, + "states_20": 346, + "states_21": 347, + "states_22": 348, + "states_23": 349, + "states_24": 350, + "states_25": 351, + "states_26": 352, + "states_27": 353, + "states_28": 354, + "states_29": 355, + "states_30": 356, + "states_31": 357, + "states_32": 358, + "states_33": 359, + "states_34": 360, + "states_35": 361, + "states_36": 362, + "states_37": 363, + "states_38": 364, + "states_39": 365, + "states_40": 366, + "states_41": 367, + "states_42": 368, + "states_43": 369, + "states_44": 370, + "states_45": 371, + "states_46": 372, + "states_47": 373, + "p_model_model_language_model_embed_tokens_weight__rows_0_32768": 374, + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768": 375, + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768": 376, + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768": 377, + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768": 378, + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768": 379, + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768": 380, + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944": 381, + "embedding__part_0": 382, + "embedding__part_1": 383, + "embedding__part_2": 384, + "embedding__part_3": 385, + "embedding__part_4": 386, + "embedding__part_5": 387, + "embedding__part_6": 388, + "embedding__part_7": 389, + "embedding__sum_0": 390, + "embedding__sum_1": 382, + "embedding__sum_2": 383, + "embedding__sum_3": 390, + "embedding__sum_4": 384, + "embedding__sum_5": 382, + "embedding": 385, + "where": 383, + "slice_1": 386, + "unsqueeze": 390, + "unsqueeze_1": 387, + "unsqueeze_2": 384, + "expand": 388, + "unsqueeze_3": 382, + "_to_copy": 389, + "matmul": 385, + "transpose": 390, + "select": 387, + "select_1": 384, + "slice_2": 386, + "slice_3": 382, + "copy": 388, + "transpose_1": 389, + "select_2": 390, + "slice_scatter": 384, + "select_scatter": 387, + "transpose_2": 386, + "transpose_7": 385, + "select_7": 388, + "slice_7": 390, + "transpose_8": 384, + "select_8": 389, + "slice_8": 387, + "copy_1": 385, + "transpose_9": 388, + "select_9": 384, + "slice_scatter_1": 389, + "select_scatter_1": 387, + "transpose_10": 386, + "transpose_12": 385, + "select_11": 384, + "cat": 389, + "cos": 388, + "mul": 387, + "sin": 386, + "mul_1": 385, + "mul_3": 384, + "type_as": 388, + "linear": 391, + "transpose_13": 392, + "linear_1": 389, + "view": 386, + "linear_2": 384, + "linear_3": 389, + "cat_1": 393, + "slice_10": 326, + "squeeze": 391, + "unsqueeze_4": 392, + "conv1d": 394, + "slice_11": 393, + "silu": 394, + "slice_12": 391, + "transpose_14": 392, + "slice_13": 388, + "slice_14": 391, + "slice_15": 393, + "view_1": 392, + "view_2": 388, + "view_3": 391, + "sigmoid": 393, + "exp": 384, + "neg": 394, + "add_2": 384, + "softplus": 389, + "mul_4": 384, + "mul_5": 389, + "sum_1": 394, + "add_3": 389, + "rsqrt_1": 394, + "mul_6": 389, + "mul_7": 392, + "sum_2": 394, + "add_4": 392, + "rsqrt_2": 394, + "mul_8": 392, + "normalized_gated_delta_rule": 395, + "slice_16": 327, + "slice_17": 388, + "transpose_15": 389, + "clone": 384, + "view_4": 388, + "view_5": 389, + "mul_10": 384, + "mul_11": 386, + "view_6": 388, + "linear_4": 389, + "add_6": 384, + "mul_13": 386, + "type_as_1": 388, + "linear_5": 392, + "linear_6": 391, + "mul_14": 393, + "linear_7": 383, + "add_9": 389, + "mul_16": 386, + "type_as_2": 388, + "linear_8": 392, + "transpose_16": 391, + "linear_9": 384, + "view_7": 383, + "linear_10": 386, + "linear_11": 384, + "cat_2": 393, + "slice_18": 328, + "squeeze_1": 392, + "unsqueeze_5": 391, + "conv1d_1": 394, + "slice_19": 393, + "silu_3": 394, + "slice_20": 392, + "transpose_17": 391, + "slice_21": 388, + "slice_22": 392, + "slice_23": 393, + "view_8": 391, + "view_9": 388, + "view_10": 392, + "sigmoid_1": 393, + "exp_1": 386, + "neg_1": 394, + "add_12": 386, + "softplus_1": 384, + "mul_17": 386, + "mul_18": 384, + "sum_3": 394, + "add_13": 384, + "rsqrt_6": 394, + "mul_19": 384, + "mul_20": 391, + "sum_4": 394, + "add_14": 391, + "rsqrt_7": 394, + "mul_21": 391, + "normalized_gated_delta_rule_1": 395, + "slice_24": 329, + "slice_25": 388, + "transpose_18": 384, + "clone_1": 386, + "view_11": 388, + "view_12": 384, + "mul_23": 386, + "mul_24": 383, + "view_13": 388, + "linear_12": 384, + "add_16": 386, + "mul_26": 383, + "type_as_3": 388, + "linear_13": 391, + "linear_14": 392, + "mul_27": 393, + "linear_15": 389, + "add_19": 384, + "mul_29": 383, + "type_as_4": 388, + "linear_16": 391, + "transpose_19": 392, + "linear_17": 386, + "view_14": 389, + "linear_18": 383, + "linear_19": 386, + "cat_3": 393, + "slice_26": 330, + "squeeze_2": 391, + "unsqueeze_6": 392, + "conv1d_2": 394, + "slice_27": 393, + "silu_6": 394, + "slice_28": 391, + "transpose_20": 392, + "slice_29": 388, + "slice_30": 391, + "slice_31": 393, + "view_15": 392, + "view_16": 388, + "view_17": 391, + "sigmoid_2": 393, + "exp_2": 383, + "neg_2": 394, + "add_22": 383, + "softplus_2": 386, + "mul_30": 383, + "mul_31": 386, + "sum_5": 394, + "add_23": 386, + "rsqrt_11": 394, + "mul_32": 386, + "mul_33": 392, + "sum_6": 394, + "add_24": 392, + "rsqrt_12": 394, + "mul_34": 392, + "normalized_gated_delta_rule_2": 395, + "slice_32": 331, + "slice_33": 388, + "transpose_21": 386, + "clone_2": 383, + "view_18": 388, + "view_19": 386, + "mul_36": 383, + "mul_37": 389, + "view_20": 388, + "linear_20": 386, + "add_26": 383, + "mul_39": 389, + "type_as_5": 388, + "linear_21": 392, + "linear_22": 391, + "mul_40": 393, + "linear_23": 384, + "add_29": 386, + "mul_42": 389, + "type_as_6": 388, + "linear_24": 392, + "view_21": 391, + "slice_34": 383, + "slice_35": 384, + "clone_3": 389, + "_unsafe_view": 384, + "view_22": 389, + "mul_44": 383, + "type_as_7": 389, + "transpose_22": 383, + "linear_25": 389, + "view_23": 392, + "mul_46": 389, + "type_as_8": 391, + "transpose_23": 389, + "linear_26": 392, + "view_24": 388, + "transpose_24": 391, + "unsqueeze_7": 388, + "unsqueeze_8": 392, + "slice_36": 393, + "slice_37": 394, + "slice_38": 383, + "slice_39": 395, + "mul_47": 389, + "slice_40": 396, + "slice_41": 397, + "neg_3": 393, + "cat_4": 398, + "mul_48": 393, + "add_36": 398, + "mul_49": 397, + "slice_42": 396, + "slice_43": 389, + "neg_4": 388, + "cat_5": 383, + "mul_50": 396, + "add_37": 389, + "cat_6": 388, + "cat_7": 398, + "cache_update": 332, + "cache_update_1": 333, + "unsqueeze_9": 399, + "expand_1": 400, + "clone_4": 401, + "_unsafe_view_1": 400, + "unsqueeze_10": 399, + "expand_2": 401, + "clone_5": 402, + "_unsafe_view_2": 401, + "transpose_25": 402, + "matmul_1": 395, + "mul_51": 399, + "add_38": 395, + "softmax": 399, + "matmul_2": 383, + "transpose_26": 389, + "clone_6": 388, + "view_25": 383, + "sigmoid_3": 389, + "mul_52": 388, + "linear_27": 384, + "add_39": 383, + "mul_54": 389, + "type_as_9": 388, + "linear_28": 392, + "linear_29": 391, + "mul_55": 393, + "linear_30": 386, + "add_42": 384, + "mul_57": 389, + "type_as_10": 388, + "linear_31": 392, + "transpose_27": 391, + "linear_32": 383, + "view_26": 386, + "linear_33": 397, + "linear_34": 396, + "cat_8": 393, + "slice_44": 334, + "squeeze_3": 392, + "unsqueeze_11": 391, + "conv1d_3": 394, + "slice_45": 393, + "silu_10": 394, + "slice_46": 392, + "transpose_28": 391, + "slice_47": 389, + "slice_48": 383, + "slice_49": 388, + "view_27": 392, + "view_28": 389, + "view_29": 383, + "sigmoid_4": 398, + "exp_3": 397, + "neg_5": 388, + "add_45": 397, + "softplus_3": 396, + "mul_58": 397, + "mul_59": 388, + "sum_7": 396, + "add_46": 388, + "rsqrt_20": 396, + "mul_60": 388, + "mul_61": 391, + "sum_8": 396, + "add_47": 392, + "rsqrt_21": 396, + "mul_62": 391, + "normalized_gated_delta_rule_3": 395, + "slice_50": 335, + "slice_51": 389, + "transpose_29": 388, + "clone_7": 383, + "view_30": 389, + "view_31": 388, + "mul_64": 383, + "mul_65": 386, + "view_32": 389, + "linear_35": 388, + "add_49": 383, + "mul_67": 386, + "type_as_11": 389, + "linear_36": 392, + "linear_37": 391, + "mul_68": 393, + "linear_38": 384, + "add_52": 388, + "mul_70": 386, + "type_as_12": 389, + "linear_39": 392, + "transpose_30": 391, + "linear_40": 383, + "view_33": 384, + "linear_41": 396, + "linear_42": 397, + "cat_9": 393, + "slice_52": 336, + "squeeze_4": 392, + "unsqueeze_12": 391, + "conv1d_4": 394, + "slice_53": 393, + "silu_13": 394, + "slice_54": 392, + "transpose_31": 391, + "slice_55": 386, + "slice_56": 383, + "slice_57": 389, + "view_34": 392, + "view_35": 386, + "view_36": 383, + "sigmoid_5": 398, + "exp_4": 396, + "neg_6": 389, + "add_55": 396, + "softplus_4": 397, + "mul_71": 396, + "mul_72": 389, + "sum_9": 397, + "add_56": 389, + "rsqrt_25": 397, + "mul_73": 389, + "mul_74": 391, + "sum_10": 397, + "add_57": 392, + "rsqrt_26": 397, + "mul_75": 391, + "normalized_gated_delta_rule_4": 395, + "slice_58": 337, + "slice_59": 386, + "transpose_32": 389, + "clone_8": 383, + "view_37": 386, + "view_38": 389, + "mul_77": 383, + "mul_78": 384, + "view_39": 386, + "linear_43": 389, + "add_59": 383, + "mul_80": 384, + "type_as_13": 386, + "linear_44": 392, + "linear_45": 391, + "mul_81": 393, + "linear_46": 388, + "add_62": 389, + "mul_83": 384, + "type_as_14": 386, + "linear_47": 392, + "transpose_33": 391, + "linear_48": 383, + "view_40": 388, + "linear_49": 397, + "linear_50": 396, + "cat_10": 393, + "slice_60": 338, + "squeeze_5": 392, + "unsqueeze_13": 391, + "conv1d_5": 394, + "slice_61": 393, + "silu_16": 394, + "slice_62": 392, + "transpose_34": 391, + "slice_63": 384, + "slice_64": 383, + "slice_65": 386, + "view_41": 392, + "view_42": 384, + "view_43": 383, + "sigmoid_6": 398, + "exp_5": 397, + "neg_7": 386, + "add_65": 397, + "softplus_5": 396, + "mul_84": 397, + "mul_85": 386, + "sum_11": 396, + "add_66": 386, + "rsqrt_30": 396, + "mul_86": 386, + "mul_87": 391, + "sum_12": 396, + "add_67": 392, + "rsqrt_31": 396, + "mul_88": 391, + "normalized_gated_delta_rule_5": 395, + "slice_66": 339, + "slice_67": 384, + "transpose_35": 386, + "clone_9": 383, + "view_44": 384, + "view_45": 386, + "mul_90": 383, + "mul_91": 388, + "view_46": 384, + "linear_51": 386, + "add_69": 383, + "mul_93": 388, + "type_as_15": 384, + "linear_52": 392, + "linear_53": 391, + "mul_94": 393, + "linear_54": 389, + "add_72": 386, + "mul_96": 388, + "type_as_16": 384, + "linear_55": 392, + "view_47": 391, + "slice_68": 383, + "slice_69": 389, + "clone_10": 388, + "_unsafe_view_3": 389, + "view_48": 388, + "mul_98": 383, + "type_as_17": 388, + "transpose_36": 383, + "linear_56": 398, + "view_49": 388, + "mul_100": 398, + "type_as_18": 388, + "transpose_37": 398, + "linear_57": 388, + "view_50": 384, + "transpose_38": 388, + "unsqueeze_14": 396, + "unsqueeze_15": 397, + "slice_70": 384, + "slice_71": 392, + "slice_72": 383, + "slice_73": 391, + "mul_101": 398, + "slice_74": 393, + "slice_75": 394, + "neg_8": 384, + "cat_11": 394, + "mul_102": 384, + "add_79": 393, + "mul_103": 398, + "slice_76": 396, + "slice_77": 384, + "neg_9": 383, + "cat_12": 384, + "mul_104": 396, + "add_80": 397, + "cat_13": 383, + "cat_14": 398, + "cache_update_2": 340, + "cache_update_3": 341, + "unsqueeze_16": 399, + "expand_3": 400, + "clone_11": 402, + "_unsafe_view_4": 401, + "unsqueeze_17": 399, + "expand_4": 400, + "clone_12": 402, + "_unsafe_view_5": 400, + "transpose_39": 402, + "matmul_3": 395, + "mul_105": 399, + "add_81": 395, + "softmax_1": 399, + "matmul_4": 384, + "transpose_40": 388, + "clone_13": 383, + "view_51": 384, + "sigmoid_7": 388, + "mul_106": 383, + "linear_58": 389, + "add_82": 384, + "mul_108": 388, + "type_as_19": 383, + "linear_59": 392, + "linear_60": 391, + "mul_109": 393, + "linear_61": 386, + "add_85": 389, + "mul_111": 388, + "type_as_20": 383, + "linear_62": 392, + "transpose_41": 391, + "linear_63": 384, + "view_52": 386, + "linear_64": 396, + "linear_65": 397, + "cat_15": 393, + "slice_78": 342, + "squeeze_6": 392, + "unsqueeze_18": 391, + "conv1d_6": 394, + "slice_79": 393, + "silu_20": 394, + "slice_80": 392, + "transpose_42": 391, + "slice_81": 388, + "slice_82": 384, + "slice_83": 383, + "view_53": 392, + "view_54": 388, + "view_55": 384, + "sigmoid_8": 398, + "exp_6": 396, + "neg_10": 383, + "add_88": 396, + "softplus_6": 397, + "mul_112": 396, + "mul_113": 383, + "sum_13": 397, + "add_89": 383, + "rsqrt_39": 397, + "mul_114": 383, + "mul_115": 391, + "sum_14": 397, + "add_90": 392, + "rsqrt_40": 397, + "mul_116": 391, + "normalized_gated_delta_rule_6": 395, + "slice_84": 343, + "slice_85": 388, + "transpose_43": 383, + "clone_14": 384, + "view_56": 388, + "view_57": 383, + "mul_118": 384, + "mul_119": 386, + "view_58": 388, + "linear_66": 383, + "add_92": 384, + "mul_121": 386, + "type_as_21": 388, + "linear_67": 392, + "linear_68": 391, + "mul_122": 393, + "linear_69": 389, + "add_95": 383, + "mul_124": 386, + "type_as_22": 388, + "linear_70": 392, + "transpose_44": 391, + "linear_71": 384, + "view_59": 389, + "linear_72": 397, + "linear_73": 396, + "cat_16": 393, + "slice_86": 344, + "squeeze_7": 392, + "unsqueeze_19": 391, + "conv1d_7": 394, + "slice_87": 393, + "silu_23": 394, + "slice_88": 392, + "transpose_45": 391, + "slice_89": 386, + "slice_90": 384, + "slice_91": 388, + "view_60": 392, + "view_61": 386, + "view_62": 384, + "sigmoid_9": 398, + "exp_7": 397, + "neg_11": 388, + "add_98": 397, + "softplus_7": 396, + "mul_125": 397, + "mul_126": 388, + "sum_15": 396, + "add_99": 388, + "rsqrt_44": 396, + "mul_127": 388, + "mul_128": 391, + "sum_16": 396, + "add_100": 392, + "rsqrt_45": 396, + "mul_129": 391, + "normalized_gated_delta_rule_7": 395, + "slice_92": 345, + "slice_93": 386, + "transpose_46": 388, + "clone_15": 384, + "view_63": 386, + "view_64": 388, + "mul_131": 384, + "mul_132": 389, + "view_65": 386, + "linear_74": 388, + "add_102": 384, + "mul_134": 389, + "type_as_23": 386, + "linear_75": 392, + "linear_76": 391, + "mul_135": 393, + "linear_77": 383, + "add_105": 388, + "mul_137": 389, + "type_as_24": 386, + "linear_78": 392, + "transpose_47": 391, + "linear_79": 384, + "view_66": 383, + "linear_80": 396, + "linear_81": 397, + "cat_17": 393, + "slice_94": 346, + "squeeze_8": 392, + "unsqueeze_20": 391, + "conv1d_8": 394, + "slice_95": 393, + "silu_26": 394, + "slice_96": 392, + "transpose_48": 391, + "slice_97": 389, + "slice_98": 384, + "slice_99": 386, + "view_67": 392, + "view_68": 389, + "view_69": 384, + "sigmoid_10": 398, + "exp_8": 396, + "neg_12": 386, + "add_108": 396, + "softplus_8": 397, + "mul_138": 396, + "mul_139": 386, + "sum_17": 397, + "add_109": 386, + "rsqrt_49": 397, + "mul_140": 386, + "mul_141": 391, + "sum_18": 397, + "add_110": 392, + "rsqrt_50": 397, + "mul_142": 391, + "normalized_gated_delta_rule_8": 395, + "slice_100": 347, + "slice_101": 389, + "transpose_49": 386, + "clone_16": 384, + "view_70": 389, + "view_71": 386, + "mul_144": 384, + "mul_145": 383, + "view_72": 389, + "linear_82": 386, + "add_112": 384, + "mul_147": 383, + "type_as_25": 389, + "linear_83": 392, + "linear_84": 391, + "mul_148": 393, + "linear_85": 388, + "add_115": 386, + "mul_150": 383, + "type_as_26": 389, + "linear_86": 392, + "view_73": 391, + "slice_102": 384, + "slice_103": 388, + "clone_17": 383, + "_unsafe_view_6": 388, + "view_74": 383, + "mul_152": 384, + "type_as_27": 383, + "transpose_50": 384, + "linear_87": 398, + "view_75": 383, + "mul_154": 398, + "type_as_28": 383, + "transpose_51": 398, + "linear_88": 383, + "view_76": 389, + "transpose_52": 383, + "unsqueeze_21": 397, + "unsqueeze_22": 396, + "slice_104": 389, + "slice_105": 392, + "slice_106": 384, + "slice_107": 391, + "mul_155": 398, + "slice_108": 393, + "slice_109": 394, + "neg_13": 389, + "cat_18": 394, + "mul_156": 389, + "add_122": 393, + "mul_157": 398, + "slice_110": 397, + "slice_111": 389, + "neg_14": 384, + "cat_19": 389, + "mul_158": 397, + "add_123": 396, + "cat_20": 384, + "cat_21": 398, + "cache_update_4": 348, + "cache_update_5": 349, + "unsqueeze_23": 399, + "expand_5": 401, + "clone_18": 402, + "_unsafe_view_7": 400, + "unsqueeze_24": 399, + "expand_6": 401, + "clone_19": 402, + "_unsafe_view_8": 401, + "transpose_53": 402, + "matmul_5": 395, + "mul_159": 399, + "add_124": 395, + "softmax_2": 399, + "matmul_6": 389, + "transpose_54": 383, + "clone_20": 384, + "view_77": 389, + "sigmoid_11": 383, + "mul_160": 384, + "linear_89": 388, + "add_125": 389, + "mul_162": 383, + "type_as_29": 384, + "linear_90": 392, + "linear_91": 391, + "mul_163": 393, + "linear_92": 386, + "add_128": 388, + "mul_165": 383, + "type_as_30": 384, + "linear_93": 392, + "transpose_55": 391, + "linear_94": 389, + "view_78": 386, + "linear_95": 397, + "linear_96": 396, + "cat_22": 393, + "slice_112": 350, + "squeeze_9": 392, + "unsqueeze_25": 391, + "conv1d_9": 394, + "slice_113": 393, + "silu_30": 394, + "slice_114": 392, + "transpose_56": 391, + "slice_115": 383, + "slice_116": 389, + "slice_117": 384, + "view_79": 392, + "view_80": 383, + "view_81": 389, + "sigmoid_12": 398, + "exp_9": 397, + "neg_15": 384, + "add_131": 397, + "softplus_9": 396, + "mul_166": 397, + "mul_167": 384, + "sum_19": 396, + "add_132": 384, + "rsqrt_58": 396, + "mul_168": 384, + "mul_169": 391, + "sum_20": 396, + "add_133": 392, + "rsqrt_59": 396, + "mul_170": 391, + "normalized_gated_delta_rule_9": 395, + "slice_118": 351, + "slice_119": 383, + "transpose_57": 384, + "clone_21": 389, + "view_82": 383, + "view_83": 384, + "mul_172": 389, + "mul_173": 386, + "view_84": 383, + "linear_97": 384, + "add_135": 389, + "mul_175": 386, + "type_as_31": 383, + "linear_98": 392, + "linear_99": 391, + "mul_176": 393, + "linear_100": 388, + "add_138": 384, + "mul_178": 386, + "type_as_32": 383, + "linear_101": 392, + "transpose_58": 391, + "linear_102": 389, + "view_85": 388, + "linear_103": 396, + "linear_104": 397, + "cat_23": 393, + "slice_120": 352, + "squeeze_10": 392, + "unsqueeze_26": 391, + "conv1d_10": 394, + "slice_121": 393, + "silu_33": 394, + "slice_122": 392, + "transpose_59": 391, + "slice_123": 386, + "slice_124": 389, + "slice_125": 383, + "view_86": 392, + "view_87": 386, + "view_88": 389, + "sigmoid_13": 398, + "exp_10": 396, + "neg_16": 383, + "add_141": 396, + "softplus_10": 397, + "mul_179": 396, + "mul_180": 383, + "sum_21": 397, + "add_142": 383, + "rsqrt_63": 397, + "mul_181": 383, + "mul_182": 391, + "sum_22": 397, + "add_143": 392, + "rsqrt_64": 397, + "mul_183": 391, + "normalized_gated_delta_rule_10": 395, + "slice_126": 353, + "slice_127": 386, + "transpose_60": 383, + "clone_22": 389, + "view_89": 386, + "view_90": 383, + "mul_185": 389, + "mul_186": 388, + "view_91": 386, + "linear_105": 383, + "add_145": 389, + "mul_188": 388, + "type_as_33": 386, + "linear_106": 392, + "linear_107": 391, + "mul_189": 393, + "linear_108": 384, + "add_148": 383, + "mul_191": 388, + "type_as_34": 386, + "linear_109": 392, + "transpose_61": 391, + "linear_110": 389, + "view_92": 384, + "linear_111": 397, + "linear_112": 396, + "cat_24": 393, + "slice_128": 354, + "squeeze_11": 392, + "unsqueeze_27": 391, + "conv1d_11": 394, + "slice_129": 393, + "silu_36": 394, + "slice_130": 392, + "transpose_62": 391, + "slice_131": 388, + "slice_132": 389, + "slice_133": 386, + "view_93": 392, + "view_94": 388, + "view_95": 389, + "sigmoid_14": 398, + "exp_11": 397, + "neg_17": 386, + "add_151": 397, + "softplus_11": 396, + "mul_192": 397, + "mul_193": 386, + "sum_23": 396, + "add_152": 386, + "rsqrt_68": 396, + "mul_194": 386, + "mul_195": 391, + "sum_24": 396, + "add_153": 392, + "rsqrt_69": 396, + "mul_196": 391, + "normalized_gated_delta_rule_11": 395, + "slice_134": 355, + "slice_135": 388, + "transpose_63": 386, + "clone_23": 389, + "view_96": 388, + "view_97": 386, + "mul_198": 389, + "mul_199": 384, + "view_98": 388, + "linear_113": 386, + "add_155": 389, + "mul_201": 384, + "type_as_35": 388, + "linear_114": 392, + "linear_115": 391, + "mul_202": 393, + "linear_116": 383, + "add_158": 386, + "mul_204": 384, + "type_as_36": 388, + "linear_117": 392, + "view_99": 391, + "slice_136": 389, + "slice_137": 383, + "clone_24": 384, + "_unsafe_view_9": 383, + "view_100": 384, + "mul_206": 389, + "type_as_37": 384, + "transpose_64": 389, + "linear_118": 398, + "view_101": 384, + "mul_208": 398, + "type_as_38": 384, + "transpose_65": 398, + "linear_119": 384, + "view_102": 388, + "transpose_66": 384, + "unsqueeze_28": 396, + "unsqueeze_29": 397, + "slice_138": 388, + "slice_139": 392, + "slice_140": 389, + "slice_141": 391, + "mul_209": 398, + "slice_142": 393, + "slice_143": 394, + "neg_18": 388, + "cat_25": 394, + "mul_210": 388, + "add_165": 393, + "mul_211": 398, + "slice_144": 396, + "slice_145": 388, + "neg_19": 389, + "cat_26": 388, + "mul_212": 396, + "add_166": 397, + "cat_27": 389, + "cat_28": 398, + "cache_update_6": 356, + "cache_update_7": 357, + "unsqueeze_30": 399, + "expand_7": 400, + "clone_25": 402, + "_unsafe_view_10": 401, + "unsqueeze_31": 399, + "expand_8": 400, + "clone_26": 402, + "_unsafe_view_11": 400, + "transpose_67": 402, + "matmul_7": 395, + "mul_213": 399, + "add_167": 395, + "softmax_3": 399, + "matmul_8": 388, + "transpose_68": 384, + "clone_27": 389, + "view_103": 388, + "sigmoid_15": 384, + "mul_214": 389, + "linear_120": 383, + "add_168": 388, + "mul_216": 384, + "type_as_39": 389, + "linear_121": 392, + "linear_122": 391, + "mul_217": 393, + "linear_123": 386, + "add_171": 383, + "mul_219": 384, + "type_as_40": 389, + "linear_124": 392, + "transpose_69": 391, + "linear_125": 388, + "view_104": 386, + "linear_126": 396, + "linear_127": 397, + "cat_29": 393, + "slice_146": 358, + "squeeze_12": 392, + "unsqueeze_32": 391, + "conv1d_12": 394, + "slice_147": 393, + "silu_40": 394, + "slice_148": 392, + "transpose_70": 391, + "slice_149": 384, + "slice_150": 388, + "slice_151": 389, + "view_105": 392, + "view_106": 384, + "view_107": 388, + "sigmoid_16": 398, + "exp_12": 396, + "neg_20": 389, + "add_174": 396, + "softplus_12": 397, + "mul_220": 396, + "mul_221": 389, + "sum_25": 397, + "add_175": 389, + "rsqrt_77": 397, + "mul_222": 389, + "mul_223": 391, + "sum_26": 397, + "add_176": 392, + "rsqrt_78": 397, + "mul_224": 391, + "normalized_gated_delta_rule_12": 395, + "slice_152": 359, + "slice_153": 384, + "transpose_71": 389, + "clone_28": 388, + "view_108": 384, + "view_109": 389, + "mul_226": 388, + "mul_227": 386, + "view_110": 384, + "linear_128": 389, + "add_178": 388, + "mul_229": 386, + "type_as_41": 384, + "linear_129": 392, + "linear_130": 391, + "mul_230": 393, + "linear_131": 383, + "add_181": 389, + "mul_232": 386, + "type_as_42": 384, + "linear_132": 392, + "transpose_72": 391, + "linear_133": 388, + "view_111": 383, + "linear_134": 397, + "linear_135": 396, + "cat_30": 393, + "slice_154": 360, + "squeeze_13": 392, + "unsqueeze_33": 391, + "conv1d_13": 394, + "slice_155": 393, + "silu_43": 394, + "slice_156": 392, + "transpose_73": 391, + "slice_157": 386, + "slice_158": 388, + "slice_159": 384, + "view_112": 392, + "view_113": 386, + "view_114": 388, + "sigmoid_17": 398, + "exp_13": 397, + "neg_21": 384, + "add_184": 397, + "softplus_13": 396, + "mul_233": 397, + "mul_234": 384, + "sum_27": 396, + "add_185": 384, + "rsqrt_82": 396, + "mul_235": 384, + "mul_236": 391, + "sum_28": 396, + "add_186": 392, + "rsqrt_83": 396, + "mul_237": 391, + "normalized_gated_delta_rule_13": 395, + "slice_160": 361, + "slice_161": 386, + "transpose_74": 384, + "clone_29": 388, + "view_115": 386, + "view_116": 384, + "mul_239": 388, + "mul_240": 383, + "view_117": 386, + "linear_136": 384, + "add_188": 388, + "mul_242": 383, + "type_as_43": 386, + "linear_137": 392, + "linear_138": 391, + "mul_243": 393, + "linear_139": 389, + "add_191": 384, + "mul_245": 383, + "type_as_44": 386, + "linear_140": 392, + "transpose_75": 391, + "linear_141": 388, + "view_118": 389, + "linear_142": 396, + "linear_143": 397, + "cat_31": 393, + "slice_162": 362, + "squeeze_14": 392, + "unsqueeze_34": 391, + "conv1d_14": 394, + "slice_163": 393, + "silu_46": 394, + "slice_164": 392, + "transpose_76": 391, + "slice_165": 383, + "slice_166": 388, + "slice_167": 386, + "view_119": 392, + "view_120": 383, + "view_121": 388, + "sigmoid_18": 398, + "exp_14": 396, + "neg_22": 386, + "add_194": 396, + "softplus_14": 397, + "mul_246": 396, + "mul_247": 386, + "sum_29": 397, + "add_195": 386, + "rsqrt_87": 397, + "mul_248": 386, + "mul_249": 391, + "sum_30": 397, + "add_196": 392, + "rsqrt_88": 397, + "mul_250": 391, + "normalized_gated_delta_rule_14": 395, + "slice_168": 363, + "slice_169": 383, + "transpose_77": 386, + "clone_30": 388, + "view_122": 383, + "view_123": 386, + "mul_252": 388, + "mul_253": 389, + "view_124": 383, + "linear_144": 386, + "add_198": 388, + "mul_255": 389, + "type_as_45": 383, + "linear_145": 392, + "linear_146": 391, + "mul_256": 393, + "linear_147": 384, + "add_201": 386, + "mul_258": 389, + "type_as_46": 383, + "linear_148": 392, + "view_125": 391, + "slice_170": 388, + "slice_171": 384, + "clone_31": 389, + "_unsafe_view_12": 384, + "view_126": 389, + "mul_260": 388, + "type_as_47": 389, + "transpose_78": 388, + "linear_149": 398, + "view_127": 389, + "mul_262": 398, + "type_as_48": 389, + "transpose_79": 398, + "linear_150": 389, + "view_128": 383, + "transpose_80": 389, + "unsqueeze_35": 397, + "unsqueeze_36": 396, + "slice_172": 383, + "slice_173": 392, + "slice_174": 388, + "slice_175": 391, + "mul_263": 398, + "slice_176": 393, + "slice_177": 394, + "neg_23": 383, + "cat_32": 394, + "mul_264": 383, + "add_208": 393, + "mul_265": 398, + "slice_178": 397, + "slice_179": 383, + "neg_24": 388, + "cat_33": 383, + "mul_266": 397, + "add_209": 396, + "cat_34": 388, + "cat_35": 398, + "cache_update_8": 364, + "cache_update_9": 365, + "unsqueeze_37": 399, + "expand_9": 401, + "clone_32": 402, + "_unsafe_view_13": 400, + "unsqueeze_38": 399, + "expand_10": 401, + "clone_33": 402, + "_unsafe_view_14": 401, + "transpose_81": 402, + "matmul_9": 395, + "mul_267": 399, + "add_210": 395, + "softmax_4": 399, + "matmul_10": 383, + "transpose_82": 389, + "clone_34": 388, + "view_129": 383, + "sigmoid_19": 389, + "mul_268": 388, + "linear_151": 384, + "add_211": 383, + "mul_270": 389, + "type_as_49": 388, + "linear_152": 392, + "linear_153": 391, + "mul_271": 393, + "linear_154": 386, + "add_214": 384, + "mul_273": 389, + "type_as_50": 388, + "linear_155": 392, + "transpose_83": 391, + "linear_156": 383, + "view_130": 386, + "linear_157": 397, + "linear_158": 396, + "cat_36": 393, + "slice_180": 366, + "squeeze_15": 392, + "unsqueeze_39": 391, + "conv1d_15": 394, + "slice_181": 393, + "silu_50": 394, + "slice_182": 392, + "transpose_84": 391, + "slice_183": 389, + "slice_184": 383, + "slice_185": 388, + "view_131": 392, + "view_132": 389, + "view_133": 383, + "sigmoid_20": 398, + "exp_15": 397, + "neg_25": 388, + "add_217": 397, + "softplus_15": 396, + "mul_274": 397, + "mul_275": 388, + "sum_31": 396, + "add_218": 388, + "rsqrt_96": 396, + "mul_276": 388, + "mul_277": 391, + "sum_32": 396, + "add_219": 392, + "rsqrt_97": 396, + "mul_278": 391, + "normalized_gated_delta_rule_15": 395, + "slice_186": 367, + "slice_187": 389, + "transpose_85": 388, + "clone_35": 383, + "view_134": 389, + "view_135": 388, + "mul_280": 383, + "mul_281": 386, + "view_136": 389, + "linear_159": 388, + "add_221": 383, + "mul_283": 386, + "type_as_51": 389, + "linear_160": 392, + "linear_161": 391, + "mul_284": 393, + "linear_162": 384, + "add_224": 388, + "mul_286": 386, + "type_as_52": 389, + "linear_163": 392, + "transpose_86": 391, + "linear_164": 383, + "view_137": 384, + "linear_165": 396, + "linear_166": 397, + "cat_37": 393, + "slice_188": 368, + "squeeze_16": 392, + "unsqueeze_40": 391, + "conv1d_16": 394, + "slice_189": 393, + "silu_53": 394, + "slice_190": 392, + "transpose_87": 391, + "slice_191": 386, + "slice_192": 383, + "slice_193": 389, + "view_138": 392, + "view_139": 386, + "view_140": 383, + "sigmoid_21": 398, + "exp_16": 396, + "neg_26": 389, + "add_227": 396, + "softplus_16": 397, + "mul_287": 396, + "mul_288": 389, + "sum_33": 397, + "add_228": 389, + "rsqrt_101": 397, + "mul_289": 389, + "mul_290": 391, + "sum_34": 397, + "add_229": 392, + "rsqrt_102": 397, + "mul_291": 391, + "normalized_gated_delta_rule_16": 395, + "slice_194": 369, + "slice_195": 386, + "transpose_88": 389, + "clone_36": 383, + "view_141": 386, + "view_142": 389, + "mul_293": 383, + "mul_294": 384, + "view_143": 386, + "linear_167": 389, + "add_231": 383, + "mul_296": 384, + "type_as_53": 386, + "linear_168": 392, + "linear_169": 391, + "mul_297": 393, + "linear_170": 388, + "add_234": 389, + "mul_299": 384, + "type_as_54": 386, + "linear_171": 392, + "transpose_89": 391, + "linear_172": 383, + "view_144": 388, + "linear_173": 397, + "linear_174": 396, + "cat_38": 393, + "slice_196": 370, + "squeeze_17": 392, + "unsqueeze_41": 391, + "conv1d_17": 394, + "slice_197": 393, + "silu_56": 394, + "slice_198": 392, + "transpose_90": 391, + "slice_199": 384, + "slice_200": 383, + "slice_201": 386, + "view_145": 392, + "view_146": 384, + "view_147": 383, + "sigmoid_22": 398, + "exp_17": 397, + "neg_27": 386, + "add_237": 397, + "softplus_17": 396, + "mul_300": 397, + "mul_301": 386, + "sum_35": 396, + "add_238": 386, + "rsqrt_106": 396, + "mul_302": 386, + "mul_303": 391, + "sum_36": 396, + "add_239": 392, + "rsqrt_107": 396, + "mul_304": 391, + "normalized_gated_delta_rule_17": 395, + "slice_202": 371, + "slice_203": 384, + "transpose_91": 386, + "clone_37": 383, + "view_148": 384, + "view_149": 386, + "mul_306": 383, + "mul_307": 388, + "view_150": 384, + "linear_175": 386, + "add_241": 383, + "mul_309": 388, + "type_as_55": 384, + "linear_176": 392, + "linear_177": 391, + "mul_310": 393, + "linear_178": 389, + "add_244": 386, + "mul_312": 388, + "type_as_56": 384, + "linear_179": 392, + "view_151": 391, + "slice_204": 383, + "slice_205": 389, + "clone_38": 388, + "_unsafe_view_15": 389, + "view_152": 388, + "mul_314": 383, + "type_as_57": 388, + "transpose_92": 383, + "linear_180": 398, + "view_153": 388, + "mul_316": 398, + "type_as_58": 388, + "transpose_93": 398, + "linear_181": 388, + "view_154": 384, + "transpose_94": 388, + "unsqueeze_42": 396, + "unsqueeze_43": 397, + "slice_206": 384, + "slice_207": 387, + "slice_208": 385, + "slice_209": 383, + "mul_317": 398, + "slice_210": 392, + "slice_211": 391, + "neg_28": 384, + "cat_39": 391, + "mul_318": 384, + "add_251": 392, + "mul_319": 398, + "slice_212": 396, + "slice_213": 384, + "neg_29": 385, + "cat_40": 384, + "mul_320": 396, + "add_252": 397, + "cat_41": 385, + "cat_42": 398, + "cache_update_10": 372, + "cache_update_11": 373, + "unsqueeze_44": 399, + "expand_11": 400, + "clone_39": 402, + "_unsafe_view_16": 401, + "unsqueeze_45": 399, + "expand_12": 400, + "clone_40": 402, + "_unsafe_view_17": 400, + "transpose_95": 402, + "matmul_11": 395, + "mul_321": 399, + "add_253": 395, + "softmax_5": 399, + "matmul_12": 384, + "transpose_96": 387, + "clone_41": 383, + "view_155": 388, + "sigmoid_23": 385, + "mul_322": 384, + "linear_182": 387, + "add_254": 383, + "mul_324": 389, + "type_as_59": 388, + "linear_183": 391, + "linear_184": 392, + "mul_325": 393, + "linear_185": 385, + "add_257": 384, + "mul_327": 386, + "type_as_60": 387, + "alias": 389, + "linear_186__part_0": 395, + "linear_186__part_1": 399, + "linear_186__part_2": 401, + "linear_186__part_3": 402, + "linear_186__part_4": 400, + "linear_186__part_5": 403, + "linear_186__part_6": 404, + "linear_186__part_7": 405, + "linear_186__cat_0_0": 406, + "linear_186__cat_0_7": 403, + "linear_186": 399 + }, + "byteLength": 4002282992 + }, + "rewrites": [ + { + "pattern": "rms_norm", + "nodes": [ + "pow_1", + "mean", + "add", + "rsqrt", + "mul_2", + "add_1", + "mul_3" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_2", + "mean_1", + "add_5", + "rsqrt_3", + "mul_9", + "mul_10" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_3", + "mean_2", + "add_7", + "rsqrt_4", + "mul_12", + "add_8", + "mul_13" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_4", + "mean_3", + "add_10", + "rsqrt_5", + "mul_15", + "add_11", + "mul_16" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_5", + "mean_4", + "add_15", + "rsqrt_8", + "mul_22", + "mul_23" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_6", + "mean_5", + "add_17", + "rsqrt_9", + "mul_25", + "add_18", + "mul_26" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_7", + "mean_6", + "add_20", + "rsqrt_10", + "mul_28", + "add_21", + "mul_29" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_8", + "mean_7", + "add_25", + "rsqrt_13", + "mul_35", + "mul_36" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_9", + "mean_8", + "add_27", + "rsqrt_14", + "mul_38", + "add_28", + "mul_39" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_10", + "mean_9", + "add_30", + "rsqrt_15", + "mul_41", + "add_31", + "mul_42" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_11", + "mean_10", + "add_32", + "rsqrt_16", + "mul_43", + "add_33", + "mul_44" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_12", + "mean_11", + "add_34", + "rsqrt_17", + "mul_45", + "add_35", + "mul_46" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_13", + "mean_12", + "add_40", + "rsqrt_18", + "mul_53", + "add_41", + "mul_54" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_14", + "mean_13", + "add_43", + "rsqrt_19", + "mul_56", + "add_44", + "mul_57" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_15", + "mean_14", + "add_48", + "rsqrt_22", + "mul_63", + "mul_64" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_16", + "mean_15", + "add_50", + "rsqrt_23", + "mul_66", + "add_51", + "mul_67" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_17", + "mean_16", + "add_53", + "rsqrt_24", + "mul_69", + "add_54", + "mul_70" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_18", + "mean_17", + "add_58", + "rsqrt_27", + "mul_76", + "mul_77" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_19", + "mean_18", + "add_60", + "rsqrt_28", + "mul_79", + "add_61", + "mul_80" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_20", + "mean_19", + "add_63", + "rsqrt_29", + "mul_82", + "add_64", + "mul_83" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_21", + "mean_20", + "add_68", + "rsqrt_32", + "mul_89", + "mul_90" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_22", + "mean_21", + "add_70", + "rsqrt_33", + "mul_92", + "add_71", + "mul_93" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_23", + "mean_22", + "add_73", + "rsqrt_34", + "mul_95", + "add_74", + "mul_96" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_24", + "mean_23", + "add_75", + "rsqrt_35", + "mul_97", + "add_76", + "mul_98" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_25", + "mean_24", + "add_77", + "rsqrt_36", + "mul_99", + "add_78", + "mul_100" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_26", + "mean_25", + "add_83", + "rsqrt_37", + "mul_107", + "add_84", + "mul_108" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_27", + "mean_26", + "add_86", + "rsqrt_38", + "mul_110", + "add_87", + "mul_111" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_28", + "mean_27", + "add_91", + "rsqrt_41", + "mul_117", + "mul_118" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_29", + "mean_28", + "add_93", + "rsqrt_42", + "mul_120", + "add_94", + "mul_121" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_30", + "mean_29", + "add_96", + "rsqrt_43", + "mul_123", + "add_97", + "mul_124" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_31", + "mean_30", + "add_101", + "rsqrt_46", + "mul_130", + "mul_131" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_32", + "mean_31", + "add_103", + "rsqrt_47", + "mul_133", + "add_104", + "mul_134" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_33", + "mean_32", + "add_106", + "rsqrt_48", + "mul_136", + "add_107", + "mul_137" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_34", + "mean_33", + "add_111", + "rsqrt_51", + "mul_143", + "mul_144" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_35", + "mean_34", + "add_113", + "rsqrt_52", + "mul_146", + "add_114", + "mul_147" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_36", + "mean_35", + "add_116", + "rsqrt_53", + "mul_149", + "add_117", + "mul_150" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_37", + "mean_36", + "add_118", + "rsqrt_54", + "mul_151", + "add_119", + "mul_152" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_38", + "mean_37", + "add_120", + "rsqrt_55", + "mul_153", + "add_121", + "mul_154" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_39", + "mean_38", + "add_126", + "rsqrt_56", + "mul_161", + "add_127", + "mul_162" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_40", + "mean_39", + "add_129", + "rsqrt_57", + "mul_164", + "add_130", + "mul_165" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_41", + "mean_40", + "add_134", + "rsqrt_60", + "mul_171", + "mul_172" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_42", + "mean_41", + "add_136", + "rsqrt_61", + "mul_174", + "add_137", + "mul_175" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_43", + "mean_42", + "add_139", + "rsqrt_62", + "mul_177", + "add_140", + "mul_178" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_44", + "mean_43", + "add_144", + "rsqrt_65", + "mul_184", + "mul_185" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_45", + "mean_44", + "add_146", + "rsqrt_66", + "mul_187", + "add_147", + "mul_188" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_46", + "mean_45", + "add_149", + "rsqrt_67", + "mul_190", + "add_150", + "mul_191" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_47", + "mean_46", + "add_154", + "rsqrt_70", + "mul_197", + "mul_198" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_48", + "mean_47", + "add_156", + "rsqrt_71", + "mul_200", + "add_157", + "mul_201" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_49", + "mean_48", + "add_159", + "rsqrt_72", + "mul_203", + "add_160", + "mul_204" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_50", + "mean_49", + "add_161", + "rsqrt_73", + "mul_205", + "add_162", + "mul_206" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_51", + "mean_50", + "add_163", + "rsqrt_74", + "mul_207", + "add_164", + "mul_208" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_52", + "mean_51", + "add_169", + "rsqrt_75", + "mul_215", + "add_170", + "mul_216" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_53", + "mean_52", + "add_172", + "rsqrt_76", + "mul_218", + "add_173", + "mul_219" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_54", + "mean_53", + "add_177", + "rsqrt_79", + "mul_225", + "mul_226" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_55", + "mean_54", + "add_179", + "rsqrt_80", + "mul_228", + "add_180", + "mul_229" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_56", + "mean_55", + "add_182", + "rsqrt_81", + "mul_231", + "add_183", + "mul_232" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_57", + "mean_56", + "add_187", + "rsqrt_84", + "mul_238", + "mul_239" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_58", + "mean_57", + "add_189", + "rsqrt_85", + "mul_241", + "add_190", + "mul_242" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_59", + "mean_58", + "add_192", + "rsqrt_86", + "mul_244", + "add_193", + "mul_245" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_60", + "mean_59", + "add_197", + "rsqrt_89", + "mul_251", + "mul_252" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_61", + "mean_60", + "add_199", + "rsqrt_90", + "mul_254", + "add_200", + "mul_255" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_62", + "mean_61", + "add_202", + "rsqrt_91", + "mul_257", + "add_203", + "mul_258" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_63", + "mean_62", + "add_204", + "rsqrt_92", + "mul_259", + "add_205", + "mul_260" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_64", + "mean_63", + "add_206", + "rsqrt_93", + "mul_261", + "add_207", + "mul_262" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_65", + "mean_64", + "add_212", + "rsqrt_94", + "mul_269", + "add_213", + "mul_270" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_66", + "mean_65", + "add_215", + "rsqrt_95", + "mul_272", + "add_216", + "mul_273" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_67", + "mean_66", + "add_220", + "rsqrt_98", + "mul_279", + "mul_280" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_68", + "mean_67", + "add_222", + "rsqrt_99", + "mul_282", + "add_223", + "mul_283" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_69", + "mean_68", + "add_225", + "rsqrt_100", + "mul_285", + "add_226", + "mul_286" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_70", + "mean_69", + "add_230", + "rsqrt_103", + "mul_292", + "mul_293" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_71", + "mean_70", + "add_232", + "rsqrt_104", + "mul_295", + "add_233", + "mul_296" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_72", + "mean_71", + "add_235", + "rsqrt_105", + "mul_298", + "add_236", + "mul_299" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_73", + "mean_72", + "add_240", + "rsqrt_108", + "mul_305", + "mul_306" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_74", + "mean_73", + "add_242", + "rsqrt_109", + "mul_308", + "add_243", + "mul_309" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_75", + "mean_74", + "add_245", + "rsqrt_110", + "mul_311", + "add_246", + "mul_312" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_76", + "mean_75", + "add_247", + "rsqrt_111", + "mul_313", + "add_248", + "mul_314" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_77", + "mean_76", + "add_249", + "rsqrt_112", + "mul_315", + "add_250", + "mul_316" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_78", + "mean_77", + "add_255", + "rsqrt_113", + "mul_323", + "add_256", + "mul_324" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_79", + "mean_78", + "add_258", + "rsqrt_114", + "mul_326", + "add_259", + "mul_327" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_1", + "mul_11" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_2", + "mul_14" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_4", + "mul_24" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_5", + "mul_27" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_7", + "mul_37" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_8", + "mul_40" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_9", + "mul_55" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_11", + "mul_65" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_12", + "mul_68" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_14", + "mul_78" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_15", + "mul_81" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_17", + "mul_91" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_18", + "mul_94" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_19", + "mul_109" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_21", + "mul_119" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_22", + "mul_122" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_24", + "mul_132" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_25", + "mul_135" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_27", + "mul_145" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_28", + "mul_148" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_29", + "mul_163" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_31", + "mul_173" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_32", + "mul_176" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_34", + "mul_186" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_35", + "mul_189" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_37", + "mul_199" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_38", + "mul_202" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_39", + "mul_217" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_41", + "mul_227" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_42", + "mul_230" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_44", + "mul_240" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_45", + "mul_243" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_47", + "mul_253" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_48", + "mul_256" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_49", + "mul_271" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_51", + "mul_281" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_52", + "mul_284" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_54", + "mul_294" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_55", + "mul_297" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_57", + "mul_307" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_58", + "mul_310" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_59", + "mul_325" + ] + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_10" + ], + "input": "states_0", + "output": "slice_10", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_16" + ], + "input": "states_1", + "output": "slice_16", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_18" + ], + "input": "states_2", + "output": "slice_18", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_24" + ], + "input": "states_3", + "output": "slice_24", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_26" + ], + "input": "states_4", + "output": "slice_26", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_32" + ], + "input": "states_5", + "output": "slice_32", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_44" + ], + "input": "states_8", + "output": "slice_44", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_50" + ], + "input": "states_9", + "output": "slice_50", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_52" + ], + "input": "states_10", + "output": "slice_52", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_58" + ], + "input": "states_11", + "output": "slice_58", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_60" + ], + "input": "states_12", + "output": "slice_60", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_66" + ], + "input": "states_13", + "output": "slice_66", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_78" + ], + "input": "states_16", + "output": "slice_78", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_84" + ], + "input": "states_17", + "output": "slice_84", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_86" + ], + "input": "states_18", + "output": "slice_86", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_92" + ], + "input": "states_19", + "output": "slice_92", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_94" + ], + "input": "states_20", + "output": "slice_94", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_100" + ], + "input": "states_21", + "output": "slice_100", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_112" + ], + "input": "states_24", + "output": "slice_112", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_118" + ], + "input": "states_25", + "output": "slice_118", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_120" + ], + "input": "states_26", + "output": "slice_120", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_126" + ], + "input": "states_27", + "output": "slice_126", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_128" + ], + "input": "states_28", + "output": "slice_128", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_134" + ], + "input": "states_29", + "output": "slice_134", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_146" + ], + "input": "states_32", + "output": "slice_146", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_152" + ], + "input": "states_33", + "output": "slice_152", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_154" + ], + "input": "states_34", + "output": "slice_154", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_160" + ], + "input": "states_35", + "output": "slice_160", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_162" + ], + "input": "states_36", + "output": "slice_162", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_168" + ], + "input": "states_37", + "output": "slice_168", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_180" + ], + "input": "states_40", + "output": "slice_180", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_186" + ], + "input": "states_41", + "output": "slice_186", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_188" + ], + "input": "states_42", + "output": "slice_188", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_194" + ], + "input": "states_43", + "output": "slice_194", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_196" + ], + "input": "states_44", + "output": "slice_196", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_202" + ], + "input": "states_45", + "output": "slice_202", + "kind": "recurrent" + } + ], + "partitions": [ + { + "node": "embedding", + "weight": "p_model_model_language_model_embed_tokens_weight", + "rowsPerShard": 32768, + "bindingLimitBytes": 134217728 + }, + { + "node": "linear_186", + "weight": "p_model_model_language_model_embed_tokens_weight", + "rowsPerShard": 32768, + "bindingLimitBytes": 134217728 + } + ] +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-64.json b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-64.json new file mode 100644 index 0000000000000000000000000000000000000000..c1de4b099604adfa035c6713103920efb447ff60 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/entrypoints/prefill-mm-64.json @@ -0,0 +1,80236 @@ +{ + "inputs": [ + "input_ids", + "position_ids", + "attention_mask", + "image_embedding", + "is_image", + "cache_position", + "states_0", + "states_1", + "states_2", + "states_3", + "states_4", + "states_5", + "states_6", + "states_7", + "states_8", + "states_9", + "states_10", + "states_11", + "states_12", + "states_13", + "states_14", + "states_15", + "states_16", + "states_17", + "states_18", + "states_19", + "states_20", + "states_21", + "states_22", + "states_23", + "states_24", + "states_25", + "states_26", + "states_27", + "states_28", + "states_29", + "states_30", + "states_31", + "states_32", + "states_33", + "states_34", + "states_35", + "states_36", + "states_37", + "states_38", + "states_39", + "states_40", + "states_41", + "states_42", + "states_43", + "states_44", + "states_45", + "states_46", + "states_47" + ], + "outputs": [ + "linear_186", + "slice_10", + "slice_16", + "slice_18", + "slice_24", + "slice_26", + "slice_32", + "cache_update", + "cache_update_1", + "slice_44", + "slice_50", + "slice_52", + "slice_58", + "slice_60", + "slice_66", + "cache_update_2", + "cache_update_3", + "slice_78", + "slice_84", + "slice_86", + "slice_92", + "slice_94", + "slice_100", + "cache_update_4", + "cache_update_5", + "slice_112", + "slice_118", + "slice_120", + "slice_126", + "slice_128", + "slice_134", + "cache_update_6", + "cache_update_7", + "slice_146", + "slice_152", + "slice_154", + "slice_160", + "slice_162", + "slice_168", + "cache_update_8", + "cache_update_9", + "slice_180", + "slice_186", + "slice_188", + "slice_194", + "slice_196", + "slice_202", + "cache_update_10", + "cache_update_11" + ], + "tensors": { + "p_model_model_language_model_embed_tokens_weight": { + "shape": [ + 248320, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1017118720, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00000.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00001.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00002.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00003.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00004.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00005.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00006.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00007.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00008.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00009.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00010.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00011.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00012.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00013.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00014.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00015.bin", + "offset": 0, + "byteLength": 10485760 + } + ] + }, + "p_model_model_language_model_layers_0_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10485760, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10493952, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10494016, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 10494080, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 35659904, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44048512, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44114048, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44179584, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44277888, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 44278400, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_0_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00015.bin", + "offset": 52667008, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00015.bin", + "offset": 52675200, + "byteLength": 14433664 + }, + { + "path": "weights/00016.bin", + "offset": 0, + "byteLength": 10732160 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 10732160, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_0_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 35897984, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_1_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61063808, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072000, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072064, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00016.bin", + "offset": 61072128, + "byteLength": 6036736 + }, + { + "path": "weights/00017.bin", + "offset": 0, + "byteLength": 19129088 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 19129088, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27517696, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27583232, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27648768, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27747072, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 27747584, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_1_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00017.bin", + "offset": 36136192, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 36144384, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00017.bin", + "offset": 61310208, + "byteLength": 5798656 + }, + { + "path": "weights/00018.bin", + "offset": 0, + "byteLength": 19367168 + } + ] + }, + "p_model_model_language_model_layers_1_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00018.bin", + "offset": 19367168, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_2_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44532992, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541184, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541248, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00018.bin", + "offset": 44541312, + "byteLength": 22567552 + }, + { + "path": "weights/00019.bin", + "offset": 0, + "byteLength": 2598272 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 2598272, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 10986880, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11052416, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11117952, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11216256, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 11216768, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_2_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00019.bin", + "offset": 19605376, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 19613568, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00019.bin", + "offset": 44779392, + "byteLength": 22329472 + }, + { + "path": "weights/00020.bin", + "offset": 0, + "byteLength": 2836352 + } + ] + }, + "p_model_model_language_model_layers_2_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 2836352, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_3_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 28002176, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 28010368, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 44787584, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 44788608, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 46885760, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 46886784, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_3_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 48983936, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_3_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00020.bin", + "offset": 57372544, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00020.bin", + "offset": 57380736, + "byteLength": 9728128 + }, + { + "path": "weights/00021.bin", + "offset": 0, + "byteLength": 15437696 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 15437696, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_3_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 40603520, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_4_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65769344, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777536, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777600, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00021.bin", + "offset": 65777664, + "byteLength": 1331200 + }, + { + "path": "weights/00022.bin", + "offset": 0, + "byteLength": 23834624 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 23834624, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32223232, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32288768, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32354304, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32452608, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 32453120, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_4_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00022.bin", + "offset": 40841728, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 40849920, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00022.bin", + "offset": 66015744, + "byteLength": 1093120 + }, + { + "path": "weights/00023.bin", + "offset": 0, + "byteLength": 24072704 + } + ] + }, + "p_model_model_language_model_layers_4_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00023.bin", + "offset": 24072704, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_5_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49238528, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246720, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246784, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00023.bin", + "offset": 49246848, + "byteLength": 17862016 + }, + { + "path": "weights/00024.bin", + "offset": 0, + "byteLength": 7303808 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 7303808, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15692416, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15757952, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15823488, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15921792, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 15922304, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_5_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00024.bin", + "offset": 24310912, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 24319104, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00024.bin", + "offset": 49484928, + "byteLength": 17623936 + }, + { + "path": "weights/00025.bin", + "offset": 0, + "byteLength": 7541888 + } + ] + }, + "p_model_model_language_model_layers_5_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 7541888, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32707712, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32715904, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32715968, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 32716032, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 57881856, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66270464, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66336000, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66401536, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66499840, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00025.bin", + "offset": 66500352, + "byteLength": 608512 + }, + { + "path": "weights/00026.bin", + "offset": 0, + "byteLength": 7780096 + } + ] + }, + "p_model_model_language_model_layers_6_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00026.bin", + "offset": 7780096, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 7788288, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 32954112, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_6_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00026.bin", + "offset": 58119936, + "byteLength": 8988928 + }, + { + "path": "weights/00027.bin", + "offset": 0, + "byteLength": 16176896 + } + ] + }, + "p_model_model_language_model_layers_7_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 16176896, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 16185088, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 32962304, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 32963328, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 35060480, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 35061504, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_7_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 37158656, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_7_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00027.bin", + "offset": 45547264, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00027.bin", + "offset": 45555456, + "byteLength": 21553408 + }, + { + "path": "weights/00028.bin", + "offset": 0, + "byteLength": 3612416 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 3612416, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_7_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 28778240, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_8_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53944064, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952256, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952320, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00028.bin", + "offset": 53952384, + "byteLength": 13156480 + }, + { + "path": "weights/00029.bin", + "offset": 0, + "byteLength": 12009344 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 12009344, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20397952, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20463488, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20529024, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20627328, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 20627840, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_8_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00029.bin", + "offset": 29016448, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 29024640, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00029.bin", + "offset": 54190464, + "byteLength": 12918400 + }, + { + "path": "weights/00030.bin", + "offset": 0, + "byteLength": 12247424 + } + ] + }, + "p_model_model_language_model_layers_8_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 12247424, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37413248, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421440, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421504, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 37421568, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00030.bin", + "offset": 62587392, + "byteLength": 4521472 + }, + { + "path": "weights/00031.bin", + "offset": 0, + "byteLength": 3867136 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3867136, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3932672, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 3998208, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 4096512, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 4097024, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_9_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00031.bin", + "offset": 12485632, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 12493824, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 37659648, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_9_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00031.bin", + "offset": 62825472, + "byteLength": 4283392 + }, + { + "path": "weights/00032.bin", + "offset": 0, + "byteLength": 20882432 + } + ] + }, + "p_model_model_language_model_layers_10_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20882432, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890624, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890688, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 20890752, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 46056576, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54445184, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54510720, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54576256, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54674560, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 54675072, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_10_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00032.bin", + "offset": 63063680, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00032.bin", + "offset": 63071872, + "byteLength": 4036992 + }, + { + "path": "weights/00033.bin", + "offset": 0, + "byteLength": 21128832 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00033.bin", + "offset": 21128832, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_10_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00033.bin", + "offset": 46294656, + "byteLength": 20814208 + }, + { + "path": "weights/00034.bin", + "offset": 0, + "byteLength": 4351616 + } + ] + }, + "p_model_model_language_model_layers_11_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 4351616, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 4359808, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 21137024, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 21138048, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 23235200, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 23236224, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_11_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 25333376, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_11_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00034.bin", + "offset": 33721984, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 33730176, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00034.bin", + "offset": 58896000, + "byteLength": 8212864 + }, + { + "path": "weights/00035.bin", + "offset": 0, + "byteLength": 16952960 + } + ] + }, + "p_model_model_language_model_layers_11_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00035.bin", + "offset": 16952960, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_12_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42118784, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42126976, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42127040, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00035.bin", + "offset": 42127104, + "byteLength": 24981760 + }, + { + "path": "weights/00036.bin", + "offset": 0, + "byteLength": 184064 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 184064, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8572672, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8638208, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8703744, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8802048, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 8802560, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_12_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00036.bin", + "offset": 17191168, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 17199360, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00036.bin", + "offset": 42365184, + "byteLength": 24743680 + }, + { + "path": "weights/00037.bin", + "offset": 0, + "byteLength": 422144 + } + ] + }, + "p_model_model_language_model_layers_12_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 422144, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25587968, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596160, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596224, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 25596288, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 50762112, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59150720, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59216256, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59281792, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59380096, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00037.bin", + "offset": 59380608, + "byteLength": 7728256 + }, + { + "path": "weights/00038.bin", + "offset": 0, + "byteLength": 660352 + } + ] + }, + "p_model_model_language_model_layers_13_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00038.bin", + "offset": 660352, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 668544, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 25834368, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_13_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00038.bin", + "offset": 51000192, + "byteLength": 16108672 + }, + { + "path": "weights/00039.bin", + "offset": 0, + "byteLength": 9057152 + } + ] + }, + "p_model_model_language_model_layers_14_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9057152, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065344, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065408, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 9065472, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 34231296, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42619904, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42685440, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42750976, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42849280, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 42849792, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_14_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00039.bin", + "offset": 51238400, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00039.bin", + "offset": 51246592, + "byteLength": 15862272 + }, + { + "path": "weights/00040.bin", + "offset": 0, + "byteLength": 9303552 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 9303552, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_14_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 34469376, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_15_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00040.bin", + "offset": 59635200, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00040.bin", + "offset": 59643392, + "byteLength": 7465472 + }, + { + "path": "weights/00041.bin", + "offset": 0, + "byteLength": 9311744 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 9311744, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 9312768, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 11409920, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 11410944, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_15_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 13508096, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_15_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00041.bin", + "offset": 21896704, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 21904896, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00041.bin", + "offset": 47070720, + "byteLength": 20038144 + }, + { + "path": "weights/00042.bin", + "offset": 0, + "byteLength": 5127680 + } + ] + }, + "p_model_model_language_model_layers_15_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 5127680, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30293504, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301696, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301760, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 30301824, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 55467648, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63856256, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63921792, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 63987328, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00042.bin", + "offset": 64085632, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00042.bin", + "offset": 64086144, + "byteLength": 3022720 + }, + { + "path": "weights/00043.bin", + "offset": 0, + "byteLength": 5365888 + } + ] + }, + "p_model_model_language_model_layers_16_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00043.bin", + "offset": 5365888, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 5374080, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 30539904, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_16_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00043.bin", + "offset": 55705728, + "byteLength": 11403136 + }, + { + "path": "weights/00044.bin", + "offset": 0, + "byteLength": 13762688 + } + ] + }, + "p_model_model_language_model_layers_17_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13762688, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13770880, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13770944, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 13771008, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 38936832, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47325440, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47390976, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47456512, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47554816, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 47555328, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_17_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00044.bin", + "offset": 55943936, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00044.bin", + "offset": 55952128, + "byteLength": 11156736 + }, + { + "path": "weights/00045.bin", + "offset": 0, + "byteLength": 14009088 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 14009088, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_17_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 39174912, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_18_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64340736, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64348928, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64348992, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00045.bin", + "offset": 64349056, + "byteLength": 2759808 + }, + { + "path": "weights/00046.bin", + "offset": 0, + "byteLength": 22406016 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 22406016, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30794624, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30860160, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 30925696, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 31024000, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 31024512, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_18_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00046.bin", + "offset": 39413120, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 39421312, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00046.bin", + "offset": 64587136, + "byteLength": 2521728 + }, + { + "path": "weights/00047.bin", + "offset": 0, + "byteLength": 22644096 + } + ] + }, + "p_model_model_language_model_layers_18_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 22644096, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 47809920, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 47818112, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 64595328, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 64596352, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00047.bin", + "offset": 66693504, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00047.bin", + "offset": 66694528, + "byteLength": 414336 + }, + { + "path": "weights/00048.bin", + "offset": 0, + "byteLength": 1682816 + } + ] + }, + "p_model_model_language_model_layers_19_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 1682816, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_19_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00048.bin", + "offset": 10071424, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 10079616, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 35245440, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_19_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00048.bin", + "offset": 60411264, + "byteLength": 6697600 + }, + { + "path": "weights/00049.bin", + "offset": 0, + "byteLength": 18468224 + } + ] + }, + "p_model_model_language_model_layers_20_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18468224, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476416, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476480, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 18476544, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 43642368, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52030976, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52096512, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52162048, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52260352, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 52260864, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_20_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00049.bin", + "offset": 60649472, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00049.bin", + "offset": 60657664, + "byteLength": 6451200 + }, + { + "path": "weights/00050.bin", + "offset": 0, + "byteLength": 18714624 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00050.bin", + "offset": 18714624, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_20_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00050.bin", + "offset": 43880448, + "byteLength": 23228416 + }, + { + "path": "weights/00051.bin", + "offset": 0, + "byteLength": 1937408 + } + ] + }, + "p_model_model_language_model_layers_21_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1937408, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945600, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945664, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 1945728, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 27111552, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35500160, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35565696, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35631232, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35729536, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 35730048, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_21_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00051.bin", + "offset": 44118656, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00051.bin", + "offset": 44126848, + "byteLength": 22982016 + }, + { + "path": "weights/00052.bin", + "offset": 0, + "byteLength": 2183808 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 2183808, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_21_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 27349632, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_22_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52515456, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_a_log": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523648, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_dt_bias": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 64, + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523712, + "byteLength": 64 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00052.bin", + "offset": 52523776, + "byteLength": 14585088 + }, + { + "path": "weights/00053.bin", + "offset": 0, + "byteLength": 10580736 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 10580736, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 18969344, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight": { + "shape": [ + 16, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 65536, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19034880, + "byteLength": 65536 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 98304, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19100416, + "byteLength": 98304 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_norm_weight": { + "shape": [ + 128 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 512, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19198720, + "byteLength": 512 + } + ] + }, + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 19199232, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_22_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00053.bin", + "offset": 27587840, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 27596032, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00053.bin", + "offset": 52761856, + "byteLength": 14347008 + }, + { + "path": "weights/00054.bin", + "offset": 0, + "byteLength": 10818816 + } + ] + }, + "p_model_model_language_model_layers_22_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 10818816, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_23_input_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 35984640, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_q_proj_weight": { + "shape": [ + 4096, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 16777216, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 35992832, + "byteLength": 16777216 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_q_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 52770048, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_k_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 52771072, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_k_norm_weight": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 1024, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 54868224, + "byteLength": 1024 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_v_proj_weight": { + "shape": [ + 512, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 2097152, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 54869248, + "byteLength": 2097152 + } + ] + }, + "p_model_model_language_model_layers_23_self_attn_o_proj_weight": { + "shape": [ + 2048, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8388608, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 56966400, + "byteLength": 8388608 + } + ] + }, + "p_model_model_language_model_layers_23_post_attention_layernorm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00054.bin", + "offset": 65355008, + "byteLength": 8192 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_gate_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00054.bin", + "offset": 65363200, + "byteLength": 1745664 + }, + { + "path": "weights/00055.bin", + "offset": 0, + "byteLength": 23420160 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_up_proj_weight": { + "shape": [ + 6144, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00055.bin", + "offset": 23420160, + "byteLength": 25165824 + } + ] + }, + "p_model_model_language_model_layers_23_mlp_down_proj_weight": { + "shape": [ + 2048, + 6144 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 25165824, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00055.bin", + "offset": 48585984, + "byteLength": 18522880 + }, + { + "path": "weights/00056.bin", + "offset": 0, + "byteLength": 6642944 + } + ] + }, + "p_model_model_language_model_norm_weight": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 8192, + "parts": [ + { + "path": "weights/00056.bin", + "offset": 6642944, + "byteLength": 8192 + } + ] + }, + "b_model_model_language_model_rotary_emb_inv_freq": { + "shape": [ + 32 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 128, + "parts": [ + { + "path": "weights/00056.bin", + "offset": 6651136, + "byteLength": 128 + } + ] + }, + "input_ids": { + "shape": [ + 1, + 64 + ], + "dtype": "int32", + "role": "input", + "byteLength": 256, + "indexBounds": [ + 0, + 248320 + ] + }, + "position_ids": { + "shape": [ + 4, + 1, + 64 + ], + "dtype": "int32", + "role": "input", + "byteLength": 1024 + }, + "attention_mask": { + "shape": [ + 1, + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "image_embedding": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "input", + "byteLength": 524288 + }, + "is_image": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "bool", + "role": "input", + "byteLength": 256 + }, + "cache_position": { + "shape": [ + 1, + 64 + ], + "dtype": "int32", + "role": "input", + "byteLength": 256, + "indexBounds": [ + 0, + 4096 + ] + }, + "states_0": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_1": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_2": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_3": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_4": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_5": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_6": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_7": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_8": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_9": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_10": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_11": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_12": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_13": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_14": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_15": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_16": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_17": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_18": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_19": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_20": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_21": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_22": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_23": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_24": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_25": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_26": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_27": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_28": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_29": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_30": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_31": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_32": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_33": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_34": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_35": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_36": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_37": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_38": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_39": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_40": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_41": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_42": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_43": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "input", + "byteLength": 98304 + }, + "states_45": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "input", + "byteLength": 1048576 + }, + "states_46": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "states_47": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "input", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "embedding": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "where": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_1": { + "shape": [ + 3, + 1, + 64 + ], + "dtype": "int32", + "role": "value", + "byteLength": 768 + }, + "unsqueeze": { + "shape": [ + 1, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "unsqueeze_1": { + "shape": [ + 1, + 1, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "unsqueeze_2": { + "shape": [ + 1, + 1, + 32, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 128 + }, + "expand": { + "shape": [ + 3, + 1, + 32, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 384 + }, + "unsqueeze_3": { + "shape": [ + 3, + 1, + 1, + 64 + ], + "dtype": "int32", + "role": "value", + "byteLength": 768 + }, + "_to_copy": { + "shape": [ + 3, + 1, + 1, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 768 + }, + "matmul": { + "shape": [ + 3, + 1, + 32, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "transpose": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "select": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "select_1": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_2": { + "shape": [ + 1, + 64, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2816 + }, + "slice_3": { + "shape": [ + 1, + 64, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2816 + }, + "copy": { + "shape": [ + 1, + 64, + 11 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2816 + }, + "transpose_1": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "select_2": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_scatter": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "select_scatter": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "transpose_2": { + "shape": [ + 3, + 1, + 32, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "transpose_7": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "select_7": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_7": { + "shape": [ + 1, + 64, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2560 + }, + "transpose_8": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "select_8": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_8": { + "shape": [ + 1, + 64, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2560 + }, + "copy_1": { + "shape": [ + 1, + 64, + 10 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2560 + }, + "transpose_9": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "select_9": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "slice_scatter_1": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "select_scatter_1": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "transpose_10": { + "shape": [ + 3, + 1, + 32, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "transpose_12": { + "shape": [ + 3, + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 24576 + }, + "select_11": { + "shape": [ + 1, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "cat": { + "shape": [ + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cos": { + "shape": [ + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "mul": { + "shape": [ + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "sin": { + "shape": [ + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "mul_1": { + "shape": [ + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "pow_1": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_2": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_1": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_13": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_1": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_2": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_3": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_1": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_10": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_4": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_11": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_12": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_14": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_13": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_14": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_15": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_1": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_2": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_3": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_2": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_4": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_5": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_1": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_3": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_1": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_6": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_7": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_2": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_4": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_2": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_8": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_16": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_17": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_15": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_4": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_5": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_2": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_1": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_5": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_3": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_9": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_10": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_1": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_11": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_6": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_4": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_6": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_2": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_7": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_4": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_12": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_8": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_13": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_1": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_5": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_2": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_6": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_14": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_7": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_9": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_4": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_3": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_10": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_5": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_15": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_11": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_16": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_2": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_8": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_16": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_9": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_7": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_10": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_11": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_2": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_18": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_1": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_5": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_1": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_19": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_3": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_20": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_17": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_21": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_22": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_23": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_8": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_9": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_10": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_1": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_1": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_1": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_12": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_1": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_17": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_18": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_3": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_13": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_6": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_19": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_20": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_4": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_14": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_7": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_21": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_1": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_24": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_25": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_18": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_1": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_11": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_12": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_5": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_4": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_15": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_8": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_22": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_23": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_4": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_24": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_13": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_12": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_16": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_6": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_5": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_17": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_9": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_25": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_18": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_26": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_13": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_5": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_14": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_27": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_15": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_19": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_7": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_6": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_20": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_10": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_28": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_21": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_29": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_4": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_16": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_19": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_17": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_14": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_18": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_19": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_3": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_26": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_2": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_6": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_2": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_27": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_6": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_28": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_20": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_29": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_30": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_31": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_15": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_16": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_17": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_2": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_2": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_2": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_22": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_2": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_30": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_31": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_5": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_23": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_11": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_32": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_33": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_6": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_24": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_12": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_34": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_2": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_32": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_33": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_21": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_2": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_18": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_19": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_8": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_7": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_25": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_13": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_35": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_36": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_7": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_37": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_20": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_20": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_26": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_9": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_8": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_27": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_14": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_38": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_28": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_39": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_5": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_21": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_8": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_22": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_40": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_23": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_29": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_10": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_9": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_30": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_15": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_41": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_31": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_42": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_6": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_24": { + "shape": [ + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "view_21": { + "shape": [ + 1, + 64, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_34": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_35": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_3": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "_unsafe_view": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_22": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_11": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_10": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_32": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "rsqrt_16": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_43": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_33": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_44": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_7": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_22": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_25": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_23": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_12": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_11": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_34": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_17": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_45": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_35": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_46": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_8": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_23": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_26": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_24": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_24": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "unsqueeze_7": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "unsqueeze_8": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_36": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_37": { + "shape": [ + 1, + 8, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_38": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_39": { + "shape": [ + 1, + 2, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_47": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_40": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_41": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "neg_3": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "cat_4": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_48": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_36": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_49": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_42": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_43": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_4": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_5": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_50": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_37": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_6": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "cat_7": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cache_update": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_1": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_9": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_1": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_4": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_1": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_10": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_2": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_5": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_2": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_25": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_1": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "mul_51": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "add_38": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "softmax": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "matmul_2": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_26": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_6": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_25": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_52": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_27": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_39": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_13": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_12": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_40": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_18": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_53": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_41": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_54": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_9": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_28": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_9": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_29": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_55": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_30": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_42": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_14": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_13": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_43": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_19": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_56": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_44": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_57": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_10": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_31": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_27": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_32": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_26": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_33": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_34": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_8": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_44": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_3": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_11": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_3": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_45": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_10": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_46": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_28": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_47": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_48": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_49": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_27": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_28": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_29": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_4": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_3": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_5": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_45": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_3": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_58": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_59": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_7": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_46": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_20": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_60": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_61": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_8": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_47": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_21": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_62": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_3": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_50": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_51": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_29": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_7": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_30": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_31": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_15": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_14": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_48": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_22": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_63": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_64": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_11": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_65": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_32": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_35": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_49": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_16": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_15": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_50": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_23": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_66": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_51": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_67": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_11": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_36": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_12": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_37": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_68": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_38": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_52": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_17": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_16": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_53": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_24": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_69": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_54": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_70": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_12": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_39": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_30": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_40": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_33": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_41": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_42": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_9": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_52": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_4": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_12": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_4": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_53": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_13": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_54": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_31": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_55": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_56": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_57": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_34": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_35": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_36": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_5": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_4": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_6": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_55": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_4": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_71": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_72": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_9": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_56": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_25": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_73": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_74": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_10": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_57": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_26": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_75": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_4": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_58": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_59": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_32": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_8": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_37": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_38": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_18": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_17": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_58": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_27": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_76": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_77": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_14": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_78": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_39": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_43": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_59": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_19": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_18": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_60": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_28": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_79": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_61": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_80": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_13": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_44": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_15": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_45": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_81": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_46": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_62": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_20": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_19": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_63": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_29": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_82": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_64": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_83": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_14": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_47": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_33": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_48": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_40": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_49": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_50": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_10": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_60": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_5": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_13": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_5": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_61": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_16": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_62": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_34": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_63": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_64": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_65": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_41": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_42": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_43": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_6": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_5": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_7": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_65": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_5": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_84": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_85": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_11": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_66": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_30": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_86": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_87": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_12": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_67": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_31": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_88": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_5": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_66": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_67": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_35": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_9": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_44": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_45": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_21": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_20": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_68": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_32": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_89": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_90": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_17": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_91": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_46": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_51": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_69": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_22": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_21": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_70": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_33": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_92": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_71": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_93": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_15": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_52": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_18": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_53": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_94": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_54": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_72": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_23": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_22": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_73": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_34": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_95": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_74": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_96": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_16": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_55": { + "shape": [ + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "view_47": { + "shape": [ + 1, + 64, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_68": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_69": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_10": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "_unsafe_view_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_48": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_24": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_23": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_75": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "rsqrt_35": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_97": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_76": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_98": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_17": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_36": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_56": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_49": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_25": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_24": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_77": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_36": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_99": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_78": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_100": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_18": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_37": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_57": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_50": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_38": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "unsqueeze_14": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "unsqueeze_15": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_70": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_71": { + "shape": [ + 1, + 8, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_72": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_73": { + "shape": [ + 1, + 2, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_101": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_74": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_75": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "neg_8": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "cat_11": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_102": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_79": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_103": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_76": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_77": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_9": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_12": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_104": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_80": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_13": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "cat_14": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cache_update_2": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_3": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_16": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_3": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_11": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_4": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_17": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_4": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_12": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_5": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_39": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_3": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "mul_105": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "add_81": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "softmax_1": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "matmul_4": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_40": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_13": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_51": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_7": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_106": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_58": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_82": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_26": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_25": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_83": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_37": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_107": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_84": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_108": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_19": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_59": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_19": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_60": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_109": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_61": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_85": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_27": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_26": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_86": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_38": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_110": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_87": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_111": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_20": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_62": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_41": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_63": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_52": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_64": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_65": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_15": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_78": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_6": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_18": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_6": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_79": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_20": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_80": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_42": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_81": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_82": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_83": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_53": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_54": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_55": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_8": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_6": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_10": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_88": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_6": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_112": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_113": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_13": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_89": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_39": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_114": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_115": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_14": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_90": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_40": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_116": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_6": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_84": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_85": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_43": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_14": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_56": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_57": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_28": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_27": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_91": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_41": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_117": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_118": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_21": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_119": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_58": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_66": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_92": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_29": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_28": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_93": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_42": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_120": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_94": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_121": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_21": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_67": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_22": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_68": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_122": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_69": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_95": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_30": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_29": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_96": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_43": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_123": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_97": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_124": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_22": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_70": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_44": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_71": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_59": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_72": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_73": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_16": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_86": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_7": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_19": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_7": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_87": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_23": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_88": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_45": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_89": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_90": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_91": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_60": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_61": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_62": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_9": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_7": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_11": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_98": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_7": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_125": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_126": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_15": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_99": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_44": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_127": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_128": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_16": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_100": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_45": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_129": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_7": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_92": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_93": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_46": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_15": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_63": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_64": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_31": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_30": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_101": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_46": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_130": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_131": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_24": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_132": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_65": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_74": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_102": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_32": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_31": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_103": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_47": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_133": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_104": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_134": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_23": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_75": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_25": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_76": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_135": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_77": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_105": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_33": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_32": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_106": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_48": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_136": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_107": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_137": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_24": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_78": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_47": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_79": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_66": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_80": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_81": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_17": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_94": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_8": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_20": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_8": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_95": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_26": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_96": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_48": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_97": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_98": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_99": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_67": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_68": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_69": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_10": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_8": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_12": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_108": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_8": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_138": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_139": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_17": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_109": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_49": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_140": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_141": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_18": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_110": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_50": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_142": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_8": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_100": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_101": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_49": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_16": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_70": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_71": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_34": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_33": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_111": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_51": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_143": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_144": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_27": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_145": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_72": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_82": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_112": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_35": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_34": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_113": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_52": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_146": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_114": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_147": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_25": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_83": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_28": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_84": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_148": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_85": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_115": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_36": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_35": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_116": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_53": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_149": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_117": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_150": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_26": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_86": { + "shape": [ + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "view_73": { + "shape": [ + 1, + 64, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_102": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_103": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_17": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "_unsafe_view_6": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_74": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_37": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_36": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_118": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "rsqrt_54": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_151": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_119": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_152": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_27": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_50": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_87": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_75": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_38": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_37": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_120": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_55": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_153": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_121": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_154": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_28": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_51": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_88": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_76": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_52": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "unsqueeze_21": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "unsqueeze_22": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_104": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_105": { + "shape": [ + 1, + 8, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_106": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_107": { + "shape": [ + 1, + 2, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_155": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_108": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_109": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "neg_13": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "cat_18": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_156": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_122": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_157": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_110": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_111": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_14": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_19": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_158": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_123": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_20": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "cat_21": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cache_update_4": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_5": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_23": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_5": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_18": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_7": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_24": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_6": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_19": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_8": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_53": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_5": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "mul_159": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "add_124": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "softmax_2": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "matmul_6": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_54": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_20": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_77": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_11": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_160": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_89": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_125": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_39": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_38": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_126": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_56": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_161": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_127": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_162": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_29": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_90": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_29": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_91": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_163": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_92": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_128": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_40": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_39": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_129": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_57": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_164": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_130": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_165": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_30": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_93": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_55": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_94": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_78": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_95": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_96": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_22": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_112": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_9": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_25": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_9": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_113": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_30": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_114": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_56": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_115": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_116": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_117": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_79": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_80": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_81": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_12": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_9": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_15": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_131": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_9": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_166": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_167": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_19": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_132": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_58": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_168": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_169": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_20": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_133": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_59": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_170": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_9": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_118": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_119": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_57": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_21": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_82": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_83": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_41": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_40": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_134": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_60": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_171": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_172": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_31": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_173": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_84": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_97": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_135": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_42": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_41": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_136": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_61": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_174": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_137": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_175": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_31": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_98": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_32": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_99": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_176": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_100": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_138": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_43": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_42": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_139": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_62": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_177": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_140": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_178": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_32": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_101": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_58": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_102": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_85": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_103": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_104": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_23": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_120": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_10": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_26": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_10": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_121": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_33": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_122": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_59": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_123": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_124": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_125": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_86": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_87": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_88": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_13": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_10": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_16": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_141": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_10": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_179": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_180": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_21": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_142": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_63": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_181": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_182": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_22": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_143": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_64": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_183": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_10": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_126": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_127": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_60": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_22": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_89": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_90": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_44": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_43": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_144": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_65": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_184": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_185": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_34": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_186": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_91": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_105": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_145": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_45": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_44": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_146": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_66": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_187": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_147": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_188": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_33": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_106": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_35": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_107": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_189": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_108": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_148": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_46": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_45": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_149": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_67": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_190": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_150": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_191": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_34": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_109": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_61": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_110": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_92": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_111": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_112": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_24": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_128": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_11": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_27": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_11": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_129": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_36": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_130": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_62": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_131": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_132": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_133": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_93": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_94": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_95": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_14": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_11": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_17": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_151": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_11": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_192": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_193": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_23": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_152": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_68": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_194": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_195": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_24": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_153": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_69": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_196": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_11": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_134": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_135": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_63": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_23": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_96": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_97": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_47": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_46": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_154": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_70": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_197": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_198": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_37": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_199": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_98": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_113": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_155": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_48": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_47": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_156": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_71": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_200": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_157": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_201": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_35": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_114": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_38": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_115": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_202": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_116": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_158": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_49": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_48": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_159": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_72": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_203": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_160": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_204": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_36": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_117": { + "shape": [ + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "view_99": { + "shape": [ + 1, + 64, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_136": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_137": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_24": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "_unsafe_view_9": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_100": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_50": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_49": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_161": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "rsqrt_73": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_205": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_162": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_206": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_37": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_64": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_118": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_101": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_51": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_50": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_163": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_74": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_207": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_164": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_208": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_38": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_65": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_119": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_102": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_66": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "unsqueeze_28": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "unsqueeze_29": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_138": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_139": { + "shape": [ + 1, + 8, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_140": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_141": { + "shape": [ + 1, + 2, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_209": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_142": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_143": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "neg_18": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "cat_25": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_210": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_165": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_211": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_144": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_145": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_19": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_26": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_212": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_166": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_27": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "cat_28": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cache_update_6": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_7": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_30": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_7": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_25": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_10": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_31": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_8": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_26": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_11": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_67": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_7": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "mul_213": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "add_167": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "softmax_3": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "matmul_8": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_68": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_27": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_103": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_15": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_214": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_120": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_168": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_52": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_51": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_169": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_75": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_215": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_170": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_216": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_39": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_121": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_39": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_122": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_217": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_123": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_171": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_53": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_52": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_172": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_76": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_218": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_173": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_219": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_40": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_124": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_69": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_125": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_104": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_126": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_127": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_29": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_146": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_12": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_32": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_12": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_147": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_40": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_148": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_70": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_149": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_150": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_151": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_105": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_106": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_107": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_16": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_12": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_20": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_174": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_12": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_220": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_221": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_25": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_175": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_77": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_222": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_223": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_26": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_176": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_78": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_224": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_12": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_152": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_153": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_71": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_28": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_108": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_109": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_54": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_53": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_177": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_79": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_225": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_226": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_41": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_227": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_110": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_128": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_178": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_55": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_54": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_179": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_80": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_228": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_180": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_229": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_41": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_129": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_42": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_130": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_230": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_131": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_181": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_56": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_55": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_182": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_81": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_231": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_183": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_232": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_42": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_132": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_72": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_133": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_111": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_134": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_135": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_30": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_154": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_13": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_33": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_13": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_155": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_43": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_156": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_73": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_157": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_158": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_159": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_112": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_113": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_114": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_17": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_13": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_21": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_184": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_13": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_233": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_234": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_27": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_185": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_82": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_235": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_236": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_28": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_186": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_83": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_237": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_13": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_160": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_161": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_74": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_29": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_115": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_116": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_57": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_56": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_187": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_84": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_238": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_239": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_44": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_240": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_117": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_136": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_188": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_58": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_57": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_189": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_85": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_241": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_190": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_242": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_43": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_137": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_45": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_138": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_243": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_139": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_191": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_59": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_58": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_192": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_86": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_244": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_193": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_245": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_44": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_140": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_75": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_141": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_118": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_142": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_143": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_31": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_162": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_14": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_34": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_14": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_163": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_46": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_164": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_76": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_165": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_166": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_167": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_119": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_120": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_121": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_18": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_14": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_22": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_194": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_14": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_246": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_247": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_29": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_195": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_87": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_248": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_249": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_30": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_196": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_88": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_250": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_14": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_168": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_169": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_77": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_30": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_122": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_123": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_60": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_59": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_197": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_89": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_251": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_252": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_47": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_253": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_124": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_144": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_198": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_61": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_60": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_199": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_90": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_254": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_200": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_255": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_45": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_145": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_48": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_146": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_256": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_147": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_201": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_62": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_61": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_202": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_91": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_257": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_203": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_258": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_46": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_148": { + "shape": [ + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "view_125": { + "shape": [ + 1, + 64, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_170": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_171": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_31": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "_unsafe_view_12": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_126": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_63": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_62": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_204": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "rsqrt_92": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_259": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_205": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_260": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_47": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_78": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_149": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_127": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_64": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_63": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_206": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_93": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_261": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_207": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_262": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_48": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_79": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_150": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_128": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_80": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "unsqueeze_35": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "unsqueeze_36": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_172": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_173": { + "shape": [ + 1, + 8, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_174": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_175": { + "shape": [ + 1, + 2, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_263": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_176": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_177": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "neg_23": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "cat_32": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_264": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_208": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_265": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_178": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_179": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_24": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_33": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_266": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_209": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_34": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "cat_35": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cache_update_8": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_9": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_37": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_9": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_32": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_13": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_38": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_10": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_33": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_14": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_81": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_9": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "mul_267": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "add_210": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "softmax_4": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "matmul_10": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_82": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_34": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_129": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_19": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_268": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_151": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_211": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_65": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_64": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_212": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_94": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_269": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_213": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_270": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_49": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_152": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_49": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_153": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_271": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_154": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_214": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_66": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_65": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_215": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_95": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_272": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_216": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_273": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_50": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_155": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_83": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_156": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_130": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_157": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_158": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_36": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_180": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_15": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_39": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_15": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_181": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_50": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_182": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_84": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_183": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_184": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_185": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_131": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_132": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_133": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_20": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_15": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_25": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_217": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_15": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_274": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_275": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_31": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_218": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_96": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_276": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_277": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_32": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_219": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_97": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_278": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_15": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_186": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_187": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_85": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_35": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_134": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_135": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_67": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_66": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_220": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_98": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_279": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_280": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_51": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_281": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_136": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_159": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_221": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_68": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_67": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_222": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_99": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_282": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_223": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_283": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_51": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_160": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_52": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_161": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_284": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_162": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_224": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_69": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_68": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_225": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_100": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_285": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_226": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_286": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_52": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_163": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_86": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_164": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_137": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_165": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_166": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_37": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_188": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_16": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_40": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_16": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_189": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_53": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_190": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_87": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_191": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_192": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_193": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_138": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_139": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_140": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_21": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_16": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_26": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_227": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_16": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_287": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_288": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_33": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_228": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_101": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_289": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_290": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_34": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_229": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_102": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_291": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_16": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_194": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_195": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_88": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_36": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_141": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_142": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_70": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_69": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_230": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_103": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_292": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_293": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_54": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_294": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_143": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_167": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_231": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_71": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_70": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_232": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_104": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_295": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_233": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_296": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_53": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_168": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_55": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_169": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_297": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_170": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_234": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_72": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_71": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_235": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_105": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_298": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_236": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_299": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_54": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_171": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_89": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_172": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_144": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_173": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "linear_174": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "cat_38": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_196": { + "shape": [ + 1, + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "squeeze_17": { + "shape": [ + 6144, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "unsqueeze_41": { + "shape": [ + 6144, + 1, + 4 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "conv1d_17": { + "shape": [ + 1, + 6144, + 71 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1744896 + }, + "slice_197": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "silu_56": { + "shape": [ + 1, + 6144, + 68 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1671168 + }, + "slice_198": { + "shape": [ + 1, + 6144, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "transpose_90": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_199": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_200": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_201": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_145": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_146": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_147": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_22": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "exp_17": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "neg_27": { + "shape": [ + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 64 + }, + "add_237": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "softplus_17": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_300": { + "shape": [ + 1, + 64, + 16 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_301": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_35": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_238": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_106": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_302": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_303": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sum_36": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_239": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_107": { + "shape": [ + 1, + 64, + 16, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_304": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "normalized_gated_delta_rule_17": { + "shape": [ + 1, + 16, + 192, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "slice_202": { + "shape": [ + 1, + 16, + 128, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_203": { + "shape": [ + 1, + 16, + 64, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_91": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_37": { + "shape": [ + 1, + 64, + 16, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_148": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_149": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_73": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_72": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "add_240": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "rsqrt_108": { + "shape": [ + 1024, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4096 + }, + "mul_305": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_306": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "silu_57": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_307": { + "shape": [ + 1024, + 128 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_150": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_175": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_241": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_74": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_73": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_242": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_109": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_308": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_243": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_309": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_55": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_176": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_58": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_177": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_310": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_178": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_244": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_75": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_74": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_245": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_110": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_311": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_246": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_312": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_56": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_179": { + "shape": [ + 1, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "view_151": { + "shape": [ + 1, + 64, + 8, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1048576 + }, + "slice_204": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "slice_205": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_38": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "_unsafe_view_15": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_152": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_76": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_75": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "add_247": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "rsqrt_111": { + "shape": [ + 1, + 64, + 8, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 2048 + }, + "mul_313": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_248": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_314": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_57": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_92": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_180": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_153": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "pow_77": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mean_76": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "add_249": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "rsqrt_112": { + "shape": [ + 1, + 64, + 2, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 512 + }, + "mul_315": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_250": { + "shape": [ + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1024 + }, + "mul_316": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "type_as_58": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_93": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "linear_181": { + "shape": [ + 1, + 64, + 512 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "view_154": { + "shape": [ + 1, + 64, + 2, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "transpose_94": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "unsqueeze_42": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "unsqueeze_43": { + "shape": [ + 1, + 1, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_206": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_207": { + "shape": [ + 1, + 8, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 393216 + }, + "slice_208": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_209": { + "shape": [ + 1, + 2, + 64, + 192 + ], + "dtype": "float32", + "role": "value", + "byteLength": 98304 + }, + "mul_317": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "slice_210": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "slice_211": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "neg_28": { + "shape": [ + 1, + 8, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 65536 + }, + "cat_39": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_318": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "add_251": { + "shape": [ + 1, + 8, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "mul_319": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "slice_212": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "slice_213": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "neg_29": { + "shape": [ + 1, + 2, + 64, + 32 + ], + "dtype": "float32", + "role": "value", + "byteLength": 16384 + }, + "cat_40": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "mul_320": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "add_252": { + "shape": [ + 1, + 2, + 64, + 64 + ], + "dtype": "float32", + "role": "value", + "byteLength": 32768 + }, + "cat_41": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "cat_42": { + "shape": [ + 1, + 2, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 131072 + }, + "cache_update_10": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "cache_update_11": { + "shape": [ + 1, + 2, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608, + "storageOrder": [ + 2, + 0, + 1, + 3 + ] + }, + "unsqueeze_44": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_11": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_39": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_16": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "unsqueeze_45": { + "shape": [ + 1, + 2, + 1, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "expand_12": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "clone_40": { + "shape": [ + 1, + 2, + 4, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "_unsafe_view_17": { + "shape": [ + 1, + 8, + 4096, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "transpose_95": { + "shape": [ + 1, + 8, + 256, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 33554432 + }, + "matmul_11": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "mul_321": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "add_253": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "softmax_5": { + "shape": [ + 1, + 8, + 64, + 4096 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "matmul_12": { + "shape": [ + 1, + 8, + 64, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "transpose_96": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "clone_41": { + "shape": [ + 1, + 64, + 8, + 256 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "view_155": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "sigmoid_23": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mul_322": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_182": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_254": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_78": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_77": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_255": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_113": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_323": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_256": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_324": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_59": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_183": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "silu_59": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_184": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "mul_325": { + "shape": [ + 1, + 64, + 6144 + ], + "dtype": "float32", + "role": "value", + "byteLength": 1572864 + }, + "linear_185": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_257": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "pow_79": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "mean_78": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "add_258": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "rsqrt_114": { + "shape": [ + 1, + 64, + 1 + ], + "dtype": "float32", + "role": "value", + "byteLength": 256 + }, + "mul_326": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "add_259": { + "shape": [ + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8192 + }, + "mul_327": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "type_as_60": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "alias": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186": { + "shape": [ + 1, + 64, + 248320 + ], + "dtype": "float32", + "role": "value", + "byteLength": 63569920 + }, + "p_model_model_language_model_embed_tokens_weight__rows_0_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 0 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00000.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00001.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_0": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 134217728 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00002.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00003.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_1": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 268435456 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00004.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00005.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_2": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 402653184 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00006.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00007.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 536870912 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00008.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00009.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_4": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 671088640 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00010.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00011.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_5": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768": { + "shape": [ + 32768, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 134217728, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 805306368 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00012.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00013.bin", + "offset": 0, + "byteLength": 67108864 + } + ] + }, + "embedding__part_6": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944": { + "shape": [ + 18944, + 2048 + ], + "dtype": "float32", + "role": "constant", + "byteLength": 77594624, + "viewOf": { + "tensor": "p_model_model_language_model_embed_tokens_weight", + "offset": 939524096 + }, + "storageDtype": "bfloat16", + "parts": [ + { + "path": "weights/00014.bin", + "offset": 0, + "byteLength": 67108864 + }, + { + "path": "weights/00015.bin", + "offset": 0, + "byteLength": 10485760 + } + ] + }, + "embedding__part_7": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "embedding__sum_0": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "embedding__sum_1": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "embedding__sum_2": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "embedding__sum_3": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "embedding__sum_4": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "embedding__sum_5": { + "shape": [ + 1, + 64, + 2048 + ], + "dtype": "float32", + "role": "value", + "byteLength": 524288 + }, + "linear_186__part_0": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_1": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_2": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_3": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_4": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_5": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_6": { + "shape": [ + 1, + 64, + 32768 + ], + "dtype": "float32", + "role": "value", + "byteLength": 8388608 + }, + "linear_186__part_7": { + "shape": [ + 1, + 64, + 18944 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4849664 + }, + "linear_186__cat_0_0": { + "shape": [ + 1, + 64, + 229376 + ], + "dtype": "float32", + "role": "value", + "byteLength": 58720256 + }, + "linear_186__cat_0_7": { + "shape": [ + 1, + 64, + 18944 + ], + "dtype": "float32", + "role": "value", + "byteLength": 4849664 + } + }, + "nodes": [ + { + "id": "embedding", + "op": "aten.embedding.default", + "args": [ + { + "tensor": "p_model_model_language_model_embed_tokens_weight" + }, + { + "tensor": "input_ids" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 146, in forward\n text_embedding = self.model.get_input_embeddings()(input_ids)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "where", + "op": "aten.where.self", + "args": [ + { + "tensor": "is_image" + }, + { + "tensor": "image_embedding" + }, + { + "tensor": "embedding" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 147, in forward\n embedding = torch.where(is_image, image_embedding, text_embedding)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_1", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "position_ids" + }, + 0, + 1, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1183, in forward\n position_ids = position_ids[1:]\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "b_model_model_language_model_rotary_emb_inv_freq" + }, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 5, in forward\n unsqueeze = torch.ops.aten.unsqueeze.default(b_model_model_language_model_rotary_emb_inv_freq, 0); b_model_model_language_model_rotary_emb_inv_freq = None" + }, + { + "id": "unsqueeze_1", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "unsqueeze" + }, + 1 + ], + "kwargs": {}, + "source": "File \".49\", line 6, in forward\n unsqueeze_1 = torch.ops.aten.unsqueeze.default(unsqueeze, 1); unsqueeze = None" + }, + { + "id": "unsqueeze_2", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "unsqueeze_1" + }, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 7, in forward\n unsqueeze_2 = torch.ops.aten.unsqueeze.default(unsqueeze_1, 3); unsqueeze_1 = None" + }, + { + "id": "expand", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_2" + }, + [ + 3, + 1, + -1, + 1 + ] + ], + "kwargs": {}, + "source": "File \".49\", line 10, in forward\n expand = torch.ops.aten.expand.default(to, [3, 1, -1, 1]); to = None" + }, + { + "id": "unsqueeze_3", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "slice_1" + }, + 2 + ], + "kwargs": {}, + "source": "File \".49\", line 13, in forward\n unsqueeze_3 = torch.ops.aten.unsqueeze.default(slice_1, 2); slice_1 = None" + }, + { + "id": "_to_copy", + "op": "aten._to_copy.default", + "args": [ + { + "tensor": "unsqueeze_3" + } + ], + "kwargs": { + "dtype": { + "dtype": "float32" + } + }, + "source": "File \".49\", line 15, in forward\n to_2 = torch.ops.aten.to.dtype(unsqueeze_3, torch.float32); unsqueeze_3 = None" + }, + { + "id": "matmul", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "expand" + }, + { + "tensor": "_to_copy" + } + ], + "kwargs": {}, + "source": "File \".49\", line 20, in forward\n matmul = torch.ops.aten.matmul.default(to_3, to_4); to_3 = to_4 = None" + }, + { + "id": "transpose", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 21, in forward\n transpose = torch.ops.aten.transpose.int(matmul, 2, 3); matmul = None" + }, + { + "id": "select", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "select_1", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose" + }, + 0, + 1 + ], + "kwargs": {}, + "source": "File \".49\", line 23, in forward\n select_1 = torch.ops.aten.select.int(transpose, 0, 1)" + }, + { + "id": "slice_2", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_1" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 24, in forward\n slice_2 = torch.ops.aten.slice.Tensor(select_1, 2, 1, 33, 3); select_1 = None" + }, + { + "id": "slice_3", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 25, in forward\n slice_3 = torch.ops.aten.slice.Tensor(select, 2, 1, 33, 3)" + }, + { + "id": "copy", + "op": "aten.copy.default", + "args": [ + { + "tensor": "slice_3" + }, + { + "tensor": "slice_2" + } + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_1", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "select_2", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_1" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "slice_scatter", + "op": "aten.slice_scatter.default", + "args": [ + { + "tensor": "select_2" + }, + { + "tensor": "copy" + }, + 2, + 1, + 33, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "select_scatter", + "op": "aten.select_scatter.default", + "args": [ + { + "tensor": "transpose_1" + }, + { + "tensor": "slice_scatter" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_2", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "select_scatter" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 26, in forward\n copy_ = torch.ops.aten.copy_.default(slice_3, slice_2); slice_3 = slice_2 = copy_ = None" + }, + { + "id": "transpose_7", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "select_7", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_7" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "slice_7", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_7" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 29, in forward\n slice_5 = torch.ops.aten.slice.Tensor(select, 2, 2, 30, 3)" + }, + { + "id": "transpose_8", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "select_8", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_8" + }, + 0, + 2 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "slice_8", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "select_8" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 28, in forward\n slice_4 = torch.ops.aten.slice.Tensor(select_2, 2, 2, 30, 3); select_2 = None" + }, + { + "id": "copy_1", + "op": "aten.copy.default", + "args": [ + { + "tensor": "slice_7" + }, + { + "tensor": "slice_8" + } + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_9", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_2" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "select_9", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_9" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "slice_scatter_1", + "op": "aten.slice_scatter.default", + "args": [ + { + "tensor": "select_9" + }, + { + "tensor": "copy_1" + }, + 2, + 2, + 30, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "select_scatter_1", + "op": "aten.select_scatter.default", + "args": [ + { + "tensor": "transpose_9" + }, + { + "tensor": "slice_scatter_1" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_10", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "select_scatter_1" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 30, in forward\n copy__1 = torch.ops.aten.copy_.default(slice_5, slice_4); slice_5 = slice_4 = copy__1 = None" + }, + { + "id": "transpose_12", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "transpose_10" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "select_11", + "op": "aten.select.int", + "args": [ + { + "tensor": "transpose_12" + }, + 0, + 0 + ], + "kwargs": {}, + "source": "File \".49\", line 22, in forward\n select = torch.ops.aten.select.int(transpose, 0, 0)" + }, + { + "id": "cat", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "select_11" + }, + { + "tensor": "select_11" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \".49\", line 31, in forward\n cat = torch.ops.aten.cat.default([select, select], -1); select = None" + }, + { + "id": "cos", + "op": "aten.cos.default", + "args": [ + { + "tensor": "cat" + } + ], + "kwargs": {}, + "source": "File \".49\", line 32, in forward\n cos = torch.ops.aten.cos.default(cat)" + }, + { + "id": "mul", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cos" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \".49\", line 33, in forward\n mul = torch.ops.aten.mul.Tensor(cos, 1.0); cos = None" + }, + { + "id": "sin", + "op": "aten.sin.default", + "args": [ + { + "tensor": "cat" + } + ], + "kwargs": {}, + "source": "File \".49\", line 34, in forward\n sin = torch.ops.aten.sin.default(cat); cat = None" + }, + { + "id": "mul_1", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "sin" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \".49\", line 35, in forward\n mul_1 = torch.ops.aten.mul.Tensor(sin, 1.0); sin = None" + }, + { + "id": "pow_1", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "where" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_1" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_2", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "where" + }, + { + "tensor": "rsqrt" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_1", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_3", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_2" + }, + { + "tensor": "add_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_3" + }, + { + "tensor": "where" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_13", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_1", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_1" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_2", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_3", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_1", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_0" + }, + { + "tensor": "transpose_13" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_10", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_1" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_4", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_1" + }, + { + "tensor": "unsqueeze_4" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_11", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_12", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_14", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_12" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_13", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_14", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_15", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_14" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_1", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_13" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_2", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_14" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_3", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_15" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_2", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_3" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_4", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg" + }, + { + "tensor": "softplus" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_5", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_1" + }, + { + "tensor": "view_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_1", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_5" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_3", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_1" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_1", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_6", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_1" + }, + { + "tensor": "rsqrt_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_7", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_2" + }, + { + "tensor": "view_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_2", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_7" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_4", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_2" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_2", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_8", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_2" + }, + { + "tensor": "rsqrt_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_6" + }, + { + "tensor": "mul_8" + }, + { + "tensor": "view_3" + }, + { + "tensor": "mul_4" + }, + { + "tensor": "sigmoid" + }, + { + "tensor": "states_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_16", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_17", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_15", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_17" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_15" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_4", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_5", + "op": "aten.view.default", + "args": [ + { + "tensor": "view" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_2", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_4" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_1", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_2" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_5", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_1" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_3", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_9", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_4" + }, + { + "tensor": "rsqrt_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_10", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_norm_weight" + }, + { + "tensor": "mul_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_1", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_11", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_10" + }, + { + "tensor": "silu_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_6", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_11" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_4", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_6" + }, + { + "tensor": "p_model_model_language_model_layers_0_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_6", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "where" + }, + { + "tensor": "linear_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_3", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_6" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_2", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_3" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_7", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_2" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_4", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_12", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_6" + }, + { + "tensor": "rsqrt_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_8", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_0_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_13", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_12" + }, + { + "tensor": "add_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_1", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_13" + }, + { + "tensor": "add_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_5", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_1" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_2", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_6", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_1" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_14", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_2" + }, + { + "tensor": "linear_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_7", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_14" + }, + { + "tensor": "p_model_model_language_model_layers_0_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_9", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_6" + }, + { + "tensor": "linear_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_4", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_9" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_3", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_4" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_10", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_3" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_5", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_15", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_9" + }, + { + "tensor": "rsqrt_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_11", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_16", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_15" + }, + { + "tensor": "add_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_2", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_16" + }, + { + "tensor": "add_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_8", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_16", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_9", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_7", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_9" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_10", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_11", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_2" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_2", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_2" + }, + { + "tensor": "transpose_16" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_18", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_2" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_1", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_5", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_1", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_2" + }, + { + "tensor": "unsqueeze_5" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_19", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_1" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_3", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_20", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_3" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_17", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_20" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_21", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_22", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_23", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_17" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_8", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_21" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_9", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_22" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_10", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_23" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_1", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_1", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_1", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_12", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_11" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_1", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_17", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_1" + }, + { + "tensor": "softplus_1" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_18", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_8" + }, + { + "tensor": "view_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_3", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_18" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_13", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_3" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_6", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_19", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_8" + }, + { + "tensor": "rsqrt_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_20", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_9" + }, + { + "tensor": "view_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_4", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_20" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_14", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_4" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_7", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_21", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_9" + }, + { + "tensor": "rsqrt_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_1", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_19" + }, + { + "tensor": "mul_21" + }, + { + "tensor": "view_10" + }, + { + "tensor": "mul_17" + }, + { + "tensor": "sigmoid_1" + }, + { + "tensor": "states_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_24", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_1" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_25", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_1" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_18", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_25" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_1", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_18" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_11", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_1" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_12", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_7" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_5", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_11" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_4", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_5" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_15", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_4" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_8", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_22", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_11" + }, + { + "tensor": "rsqrt_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_23", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_norm_weight" + }, + { + "tensor": "mul_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_4", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_24", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_23" + }, + { + "tensor": "silu_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_13", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_24" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_12", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_13" + }, + { + "tensor": "p_model_model_language_model_layers_1_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_16", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_9" + }, + { + "tensor": "linear_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_6", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_16" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_5", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_6" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_17", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_5" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_9", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_25", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_16" + }, + { + "tensor": "rsqrt_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_18", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_1_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_26", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_25" + }, + { + "tensor": "add_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_3", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_26" + }, + { + "tensor": "add_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_13", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_3" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_5", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_14", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_3" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_27", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_5" + }, + { + "tensor": "linear_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_15", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_27" + }, + { + "tensor": "p_model_model_language_model_layers_1_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_19", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_16" + }, + { + "tensor": "linear_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_7", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_19" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_6", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_7" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_20", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_6" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_10", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_28", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_19" + }, + { + "tensor": "rsqrt_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_21", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_29", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_28" + }, + { + "tensor": "add_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_4", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_29" + }, + { + "tensor": "add_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_16", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_19", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_16" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_17", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_14", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_17" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_18", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_19", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_4" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_3", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_4" + }, + { + "tensor": "transpose_19" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_26", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_3" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_2", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_6", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_2" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_2", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_3" + }, + { + "tensor": "unsqueeze_6" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_27", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_2" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_6", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_28", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_6" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_20", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_28" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_29", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_30", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_31", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_20" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_15", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_29" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_16", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_30" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_17", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_31" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_2", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_2", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_2", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_22", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_19" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_2", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_30", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_2" + }, + { + "tensor": "softplus_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_31", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_15" + }, + { + "tensor": "view_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_5", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_31" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_23", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_5" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_11", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_32", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_15" + }, + { + "tensor": "rsqrt_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_33", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_16" + }, + { + "tensor": "view_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_6", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_33" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_24", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_6" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_12", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_34", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_16" + }, + { + "tensor": "rsqrt_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_2", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_32" + }, + { + "tensor": "mul_34" + }, + { + "tensor": "view_17" + }, + { + "tensor": "mul_30" + }, + { + "tensor": "sigmoid_2" + }, + { + "tensor": "states_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_32", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_2" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_33", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_2" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_21", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_33" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_2", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_21" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_18", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_2" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_19", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_14" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_8", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_18" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_7", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_8" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_25", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_7" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_13", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_35", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_18" + }, + { + "tensor": "rsqrt_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_36", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_norm_weight" + }, + { + "tensor": "mul_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_7", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_37", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_36" + }, + { + "tensor": "silu_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_20", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_37" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_20", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_20" + }, + { + "tensor": "p_model_model_language_model_layers_2_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_26", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_19" + }, + { + "tensor": "linear_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_9", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_26" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_8", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_9" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_27", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_8" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_14", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_38", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_26" + }, + { + "tensor": "rsqrt_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_28", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_2_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_39", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_38" + }, + { + "tensor": "add_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_5", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_39" + }, + { + "tensor": "add_26" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_21", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_5" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_8", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_22", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_5" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_40", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_8" + }, + { + "tensor": "linear_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_23", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_40" + }, + { + "tensor": "p_model_model_language_model_layers_2_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_29", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_26" + }, + { + "tensor": "linear_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_10", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_29" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_9", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_10" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_30", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_9" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_15", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_41", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_29" + }, + { + "tensor": "rsqrt_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_31", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_42", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_41" + }, + { + "tensor": "add_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_6", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_42" + }, + { + "tensor": "add_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_24", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_21", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_24" + }, + [ + 1, + 64, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_34", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_21" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_35", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_21" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_3", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_35" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_3" + }, + [ + 1, + 64, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_22", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_34" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_11", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_22" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_10", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_11" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_32", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_10" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_16", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_43", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_22" + }, + { + "tensor": "rsqrt_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_33", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_44", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_43" + }, + { + "tensor": "add_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_7", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_44" + }, + { + "tensor": "view_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_22", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_7" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_25", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_23", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_25" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_12", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_23" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_11", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_12" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_34", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_11" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_17", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_45", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_23" + }, + { + "tensor": "rsqrt_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_35", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_46", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_45" + }, + { + "tensor": "add_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_8", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_46" + }, + { + "tensor": "view_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_23", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_26", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_6" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_24", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_26" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_24", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_24" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_7", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_8", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_36", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_22" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_37", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_22" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_38", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_23" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_39", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_23" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_47", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + { + "tensor": "unsqueeze_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_40", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_41", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_36" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_3", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_4", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_3" + }, + { + "tensor": "slice_40" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_48", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_4" + }, + { + "tensor": "unsqueeze_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_36", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_47" + }, + { + "tensor": "mul_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_49", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + { + "tensor": "unsqueeze_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_42", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_43", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_38" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_4", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_5", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_4" + }, + { + "tensor": "slice_42" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_50", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_5" + }, + { + "tensor": "unsqueeze_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_37", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_49" + }, + { + "tensor": "mul_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_6", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_36" + }, + { + "tensor": "slice_37" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_7", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_37" + }, + { + "tensor": "slice_39" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_6" + }, + { + "tensor": "cat_7" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_1", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_7" + }, + { + "tensor": "transpose_24" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_9", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_1", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_9" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_4", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_1" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_1", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_4" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_10", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_1" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_2", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_10" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_5", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_2" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_2", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_5" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_25", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_1" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_1", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_6" + }, + { + "tensor": "transpose_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_51", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_1" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_38", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_51" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_38" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_2", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax" + }, + { + "tensor": "_unsafe_view_2" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_26", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_2" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_6", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_26" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_25", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_6" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_3", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_52", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_25" + }, + { + "tensor": "sigmoid_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_27", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_52" + }, + { + "tensor": "p_model_model_language_model_layers_3_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_39", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_29" + }, + { + "tensor": "linear_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_13", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_39" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_12", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_13" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_40", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_12" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_18", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_40" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_53", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_39" + }, + { + "tensor": "rsqrt_18" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_41", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_3_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_54", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_53" + }, + { + "tensor": "add_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_9", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_54" + }, + { + "tensor": "add_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_28", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_9" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_9", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_29", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_9" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_55", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_9" + }, + { + "tensor": "linear_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_30", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_55" + }, + { + "tensor": "p_model_model_language_model_layers_3_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_42", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_39" + }, + { + "tensor": "linear_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_14", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_42" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_13", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_14" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_43", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_13" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_19", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_56", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_42" + }, + { + "tensor": "rsqrt_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_44", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_57", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_56" + }, + { + "tensor": "add_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_10", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_57" + }, + { + "tensor": "add_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_31", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_27", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_31" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_32", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_26", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_32" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_33", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_34", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_10" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_8", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_8" + }, + { + "tensor": "transpose_27" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_44", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_8" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_3", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_11", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_3" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_3", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_8" + }, + { + "tensor": "unsqueeze_11" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_45", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_3" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_10", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_46", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_10" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_28", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_46" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_47", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_48", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_49", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_28" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_27", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_47" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_28", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_48" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_29", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_49" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_4", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_3", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_5", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_45", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_34" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_3", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_58", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_5" + }, + { + "tensor": "softplus_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_59", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_27" + }, + { + "tensor": "view_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_7", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_59" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_46", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_7" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_20", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_60", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_27" + }, + { + "tensor": "rsqrt_20" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_61", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_28" + }, + { + "tensor": "view_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_8", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_61" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_47", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_8" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_21", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_62", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_28" + }, + { + "tensor": "rsqrt_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_3", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_60" + }, + { + "tensor": "mul_62" + }, + { + "tensor": "view_29" + }, + { + "tensor": "mul_58" + }, + { + "tensor": "sigmoid_4" + }, + { + "tensor": "states_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_50", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_3" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_51", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_3" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_29", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_51" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_7", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_29" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_30", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_7" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_31", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_26" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_15", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_30" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_14", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_15" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_48", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_14" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_22", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_63", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_30" + }, + { + "tensor": "rsqrt_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_64", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_norm_weight" + }, + { + "tensor": "mul_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_11", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_65", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_64" + }, + { + "tensor": "silu_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_32", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_65" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_35", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_32" + }, + { + "tensor": "p_model_model_language_model_layers_4_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_49", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_42" + }, + { + "tensor": "linear_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_16", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_49" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_15", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_16" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_50", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_15" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_23", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_66", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_49" + }, + { + "tensor": "rsqrt_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_51", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_4_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_67", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_66" + }, + { + "tensor": "add_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_11", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_67" + }, + { + "tensor": "add_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_36", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_11" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_12", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_37", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_11" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_68", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_12" + }, + { + "tensor": "linear_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_38", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_68" + }, + { + "tensor": "p_model_model_language_model_layers_4_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_52", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_49" + }, + { + "tensor": "linear_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_17", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_52" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_16", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_17" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_53", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_16" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_24", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_69", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_52" + }, + { + "tensor": "rsqrt_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_54", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_70", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_69" + }, + { + "tensor": "add_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_12", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_70" + }, + { + "tensor": "add_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_39", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_30", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_39" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_40", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_33", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_40" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_41", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_42", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_12" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_9", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_10" + }, + { + "tensor": "transpose_30" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_52", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_9" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_4", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_12", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_4" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_4", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_9" + }, + { + "tensor": "unsqueeze_12" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_53", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_4" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_13", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_54", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_13" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_31", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_54" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_55", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_56", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_57", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_31" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_34", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_55" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_35", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_56" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_36", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_57" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_5", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_4", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_6", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_55", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_42" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_4", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_55" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_71", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_6" + }, + { + "tensor": "softplus_4" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_72", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_34" + }, + { + "tensor": "view_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_9", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_72" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_56", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_9" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_25", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_56" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_73", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_34" + }, + { + "tensor": "rsqrt_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_74", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_35" + }, + { + "tensor": "view_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_10", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_74" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_57", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_10" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_26", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_75", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_35" + }, + { + "tensor": "rsqrt_26" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_4", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_73" + }, + { + "tensor": "mul_75" + }, + { + "tensor": "view_36" + }, + { + "tensor": "mul_71" + }, + { + "tensor": "sigmoid_5" + }, + { + "tensor": "states_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_58", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_4" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_59", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_4" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_32", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_59" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_8", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_32" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_37", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_8" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_38", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_33" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_18", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_37" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_17", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_18" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_58", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_17" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_27", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_76", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_37" + }, + { + "tensor": "rsqrt_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_77", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_norm_weight" + }, + { + "tensor": "mul_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_14", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_78", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_77" + }, + { + "tensor": "silu_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_39", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_78" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_43", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_39" + }, + { + "tensor": "p_model_model_language_model_layers_5_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_59", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_52" + }, + { + "tensor": "linear_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_19", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_59" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_18", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_19" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_60", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_18" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_28", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_79", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_59" + }, + { + "tensor": "rsqrt_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_61", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_5_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_80", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_79" + }, + { + "tensor": "add_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_13", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_80" + }, + { + "tensor": "add_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_44", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_13" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_15", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_45", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_13" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_81", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_15" + }, + { + "tensor": "linear_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_46", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_81" + }, + { + "tensor": "p_model_model_language_model_layers_5_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_62", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_59" + }, + { + "tensor": "linear_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_20", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_62" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_19", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_20" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_63", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_19" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_29", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_82", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_62" + }, + { + "tensor": "rsqrt_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_64", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_83", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_82" + }, + { + "tensor": "add_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_14", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_83" + }, + { + "tensor": "add_62" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_47", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_33", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_47" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_48", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_40", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_48" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_49", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_50", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_14" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_10", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_12" + }, + { + "tensor": "transpose_33" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_60", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_10" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_5", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_13", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_5" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_5", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_10" + }, + { + "tensor": "unsqueeze_13" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_61", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_5" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_16", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_62", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_16" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_34", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_62" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_63", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_64", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_65", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_34" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_41", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_63" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_42", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_64" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_43", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_65" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_6", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_5", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_7", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_65", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_50" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_5", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_65" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_84", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_7" + }, + { + "tensor": "softplus_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_85", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_41" + }, + { + "tensor": "view_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_11", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_85" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_66", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_11" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_30", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_86", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_41" + }, + { + "tensor": "rsqrt_30" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_87", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_42" + }, + { + "tensor": "view_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_12", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_87" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_67", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_12" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_31", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_88", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_42" + }, + { + "tensor": "rsqrt_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_5", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_86" + }, + { + "tensor": "mul_88" + }, + { + "tensor": "view_43" + }, + { + "tensor": "mul_84" + }, + { + "tensor": "sigmoid_6" + }, + { + "tensor": "states_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_66", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_5" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_67", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_5" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_35", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_67" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_9", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_35" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_44", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_9" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_45", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_40" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_21", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_44" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_20", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_21" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_68", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_20" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_32", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_89", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_44" + }, + { + "tensor": "rsqrt_32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_90", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_norm_weight" + }, + { + "tensor": "mul_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_17", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_91", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_90" + }, + { + "tensor": "silu_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_46", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_91" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_51", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_46" + }, + { + "tensor": "p_model_model_language_model_layers_6_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_69", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_62" + }, + { + "tensor": "linear_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_22", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_69" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_21", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_22" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_70", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_21" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_33", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_70" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_92", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_69" + }, + { + "tensor": "rsqrt_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_71", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_6_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_93", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_92" + }, + { + "tensor": "add_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_15", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_93" + }, + { + "tensor": "add_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_52", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_15" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_18", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_53", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_15" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_94", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_18" + }, + { + "tensor": "linear_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_54", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_94" + }, + { + "tensor": "p_model_model_language_model_layers_6_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_72", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_69" + }, + { + "tensor": "linear_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_23", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_72" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_22", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_23" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_73", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_22" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_34", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_73" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_95", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_72" + }, + { + "tensor": "rsqrt_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_74", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_96", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_95" + }, + { + "tensor": "add_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_16", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_96" + }, + { + "tensor": "add_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_55", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_47", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_55" + }, + [ + 1, + 64, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_68", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_47" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_69", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_47" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_10", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_69" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_3", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_10" + }, + [ + 1, + 64, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_48", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_68" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_24", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_48" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_23", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_24" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_75", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_23" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_35", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_97", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_48" + }, + { + "tensor": "rsqrt_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_76", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_98", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_97" + }, + { + "tensor": "add_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_17", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_98" + }, + { + "tensor": "view_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_36", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_17" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_56", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_49", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_56" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_25", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_49" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_24", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_25" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_77", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_24" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_36", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_99", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_49" + }, + { + "tensor": "rsqrt_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_78", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_100", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_99" + }, + { + "tensor": "add_78" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_18", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_100" + }, + { + "tensor": "view_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_37", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_18" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_57", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_16" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_50", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_57" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_38", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_50" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_14", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_15", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_70", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_36" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_71", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_36" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_72", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_37" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_73", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_37" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_101", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + { + "tensor": "unsqueeze_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_74", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_75", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_70" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_8", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_11", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_8" + }, + { + "tensor": "slice_74" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_102", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_11" + }, + { + "tensor": "unsqueeze_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_79", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_101" + }, + { + "tensor": "mul_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_103", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + { + "tensor": "unsqueeze_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_76", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_77", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_72" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_9", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_12", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_9" + }, + { + "tensor": "slice_76" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_104", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_12" + }, + { + "tensor": "unsqueeze_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_80", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_103" + }, + { + "tensor": "mul_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_13", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_79" + }, + { + "tensor": "slice_71" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_14", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_80" + }, + { + "tensor": "slice_73" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_2", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_14" + }, + { + "tensor": "cat_14" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_3", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_15" + }, + { + "tensor": "transpose_38" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_16", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_2" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_3", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_16" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_11", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_3" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_4", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_11" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_17", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_3" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_4", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_17" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_12", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_4" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_5", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_12" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_39", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_4" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_3", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_13" + }, + { + "tensor": "transpose_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_105", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_3" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_81", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_105" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_1", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_81" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_4", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_1" + }, + { + "tensor": "_unsafe_view_5" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_40", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_4" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_13", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_40" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_51", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_13" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_7", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_3" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_106", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_51" + }, + { + "tensor": "sigmoid_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_58", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_106" + }, + { + "tensor": "p_model_model_language_model_layers_7_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_82", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_72" + }, + { + "tensor": "linear_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_26", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_82" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_25", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_26" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_83", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_25" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_37", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_107", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_82" + }, + { + "tensor": "rsqrt_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_84", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_7_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_108", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_107" + }, + { + "tensor": "add_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_19", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_108" + }, + { + "tensor": "add_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_59", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_19" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_19", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_60", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_19" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_109", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_19" + }, + { + "tensor": "linear_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_61", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_109" + }, + { + "tensor": "p_model_model_language_model_layers_7_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_85", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_82" + }, + { + "tensor": "linear_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_27", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_85" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_26", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_27" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_86", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_26" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_38", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_110", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_85" + }, + { + "tensor": "rsqrt_38" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_87", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_111", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_110" + }, + { + "tensor": "add_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_20", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_111" + }, + { + "tensor": "add_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_62", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_41", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_62" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_63", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_52", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_63" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_64", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_65", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_20" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_15", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_16" + }, + { + "tensor": "transpose_41" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_78", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_15" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_6", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_18", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_6" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_6", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_15" + }, + { + "tensor": "unsqueeze_18" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_79", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_6" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_20", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_80", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_20" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_42", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_80" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_81", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_82", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_83", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_42" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_53", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_81" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_54", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_82" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_55", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_83" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_8", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_6", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_10", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_88", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_65" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_6", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_88" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_112", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_10" + }, + { + "tensor": "softplus_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_113", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_53" + }, + { + "tensor": "view_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_13", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_113" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_89", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_13" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_39", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_114", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_53" + }, + { + "tensor": "rsqrt_39" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_115", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_54" + }, + { + "tensor": "view_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_14", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_115" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_90", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_14" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_40", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_116", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_54" + }, + { + "tensor": "rsqrt_40" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_6", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_114" + }, + { + "tensor": "mul_116" + }, + { + "tensor": "view_55" + }, + { + "tensor": "mul_112" + }, + { + "tensor": "sigmoid_8" + }, + { + "tensor": "states_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_84", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_6" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_85", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_6" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_43", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_85" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_14", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_43" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_56", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_14" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_57", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_52" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_28", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_56" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_27", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_28" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_91", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_27" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_41", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_117", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_56" + }, + { + "tensor": "rsqrt_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_118", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_norm_weight" + }, + { + "tensor": "mul_117" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_21", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_119", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_118" + }, + { + "tensor": "silu_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_58", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_119" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_66", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_58" + }, + { + "tensor": "p_model_model_language_model_layers_8_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_92", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_85" + }, + { + "tensor": "linear_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_29", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_92" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_28", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_29" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_93", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_28" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_42", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_120", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_92" + }, + { + "tensor": "rsqrt_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_94", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_8_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_121", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_120" + }, + { + "tensor": "add_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_21", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_121" + }, + { + "tensor": "add_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_67", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_21" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_22", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_68", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_21" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_122", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_22" + }, + { + "tensor": "linear_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_69", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_122" + }, + { + "tensor": "p_model_model_language_model_layers_8_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_95", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_92" + }, + { + "tensor": "linear_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_30", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_95" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_29", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_30" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_96", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_29" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_43", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_96" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_123", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_95" + }, + { + "tensor": "rsqrt_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_97", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_124", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_123" + }, + { + "tensor": "add_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_22", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_124" + }, + { + "tensor": "add_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_70", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_44", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_70" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_71", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_59", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_71" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_72", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_73", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_22" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_16", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_18" + }, + { + "tensor": "transpose_44" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_86", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_16" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_7", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_19", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_7" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_7", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_16" + }, + { + "tensor": "unsqueeze_19" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_87", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_7" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_23", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_88", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_23" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_45", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_88" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_89", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_90", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_91", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_45" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_60", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_89" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_61", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_90" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_62", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_91" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_9", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_7", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_11", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_98", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_73" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_7", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_125", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_11" + }, + { + "tensor": "softplus_7" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_126", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_60" + }, + { + "tensor": "view_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_15", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_126" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_99", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_15" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_44", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_127", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_60" + }, + { + "tensor": "rsqrt_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_128", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_61" + }, + { + "tensor": "view_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_16", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_128" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_100", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_16" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_45", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_129", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_61" + }, + { + "tensor": "rsqrt_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_7", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_127" + }, + { + "tensor": "mul_129" + }, + { + "tensor": "view_62" + }, + { + "tensor": "mul_125" + }, + { + "tensor": "sigmoid_9" + }, + { + "tensor": "states_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_92", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_7" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_93", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_7" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_46", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_93" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_15", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_46" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_63", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_15" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_64", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_59" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_31", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_63" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_30", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_31" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_101", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_30" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_46", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_130", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_63" + }, + { + "tensor": "rsqrt_46" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_131", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_norm_weight" + }, + { + "tensor": "mul_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_24", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_132", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_131" + }, + { + "tensor": "silu_24" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_65", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_132" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_74", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_65" + }, + { + "tensor": "p_model_model_language_model_layers_9_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_102", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_95" + }, + { + "tensor": "linear_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_32", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_102" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_31", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_32" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_103", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_31" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_47", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_133", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_102" + }, + { + "tensor": "rsqrt_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_104", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_9_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_134", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_133" + }, + { + "tensor": "add_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_23", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_134" + }, + { + "tensor": "add_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_75", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_23" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_25", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_76", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_23" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_135", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_25" + }, + { + "tensor": "linear_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_77", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_135" + }, + { + "tensor": "p_model_model_language_model_layers_9_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_105", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_102" + }, + { + "tensor": "linear_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_33", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_105" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_32", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_33" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_106", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_32" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_48", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_136", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_105" + }, + { + "tensor": "rsqrt_48" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_107", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_137", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_136" + }, + { + "tensor": "add_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_24", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_137" + }, + { + "tensor": "add_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_78", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_47", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_78" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_79", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_66", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_79" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_80", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_81", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_24" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_17", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_20" + }, + { + "tensor": "transpose_47" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_94", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_17" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_8", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_20", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_8" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_8", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_17" + }, + { + "tensor": "unsqueeze_20" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_95", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_8" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_26", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_96", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_26" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_48", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_96" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_97", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_98", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_99", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_48" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_67", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_97" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_68", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_98" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_69", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_99" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_10", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_8", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_12", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_108", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_81" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_8", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_138", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_12" + }, + { + "tensor": "softplus_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_139", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_67" + }, + { + "tensor": "view_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_17", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_139" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_109", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_17" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_49", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_140", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_67" + }, + { + "tensor": "rsqrt_49" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_141", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_68" + }, + { + "tensor": "view_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_18", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_141" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_110", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_18" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_50", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_110" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_142", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_68" + }, + { + "tensor": "rsqrt_50" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_8", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_140" + }, + { + "tensor": "mul_142" + }, + { + "tensor": "view_69" + }, + { + "tensor": "mul_138" + }, + { + "tensor": "sigmoid_10" + }, + { + "tensor": "states_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_100", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_8" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_101", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_8" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_49", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_101" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_16", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_49" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_70", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_16" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_71", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_66" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_34", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_70" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_33", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_34" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_111", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_33" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_51", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_143", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_70" + }, + { + "tensor": "rsqrt_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_144", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_norm_weight" + }, + { + "tensor": "mul_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_27", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_145", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_144" + }, + { + "tensor": "silu_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_72", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_145" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_82", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_72" + }, + { + "tensor": "p_model_model_language_model_layers_10_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_112", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_105" + }, + { + "tensor": "linear_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_35", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_112" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_34", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_35" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_113", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_34" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_52", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_146", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_112" + }, + { + "tensor": "rsqrt_52" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_114", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_10_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_147", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_146" + }, + { + "tensor": "add_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_25", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_147" + }, + { + "tensor": "add_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_83", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_25" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_28", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_84", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_25" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_148", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_28" + }, + { + "tensor": "linear_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_85", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_148" + }, + { + "tensor": "p_model_model_language_model_layers_10_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_115", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_112" + }, + { + "tensor": "linear_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_36", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_115" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_35", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_36" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_116", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_35" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_53", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_149", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_115" + }, + { + "tensor": "rsqrt_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_117", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_150", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_149" + }, + { + "tensor": "add_117" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_26", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_150" + }, + { + "tensor": "add_115" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_86", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_73", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_86" + }, + [ + 1, + 64, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_102", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_73" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_103", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_73" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_17", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_103" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_6", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_17" + }, + [ + 1, + 64, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_74", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_102" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_37", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_74" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_36", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_37" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_118", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_36" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_54", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_118" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_151", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_74" + }, + { + "tensor": "rsqrt_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_119", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_152", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_151" + }, + { + "tensor": "add_119" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_27", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_152" + }, + { + "tensor": "view_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_50", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_27" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_87", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_75", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_87" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_38", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_75" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_37", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_38" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_120", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_37" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_55", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_153", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_75" + }, + { + "tensor": "rsqrt_55" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_121", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_154", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_153" + }, + { + "tensor": "add_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_28", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_154" + }, + { + "tensor": "view_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_51", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_28" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_88", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_26" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_76", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_88" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_52", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_76" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_21", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_22", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_104", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_50" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_105", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_50" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_106", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_51" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_107", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_51" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_155", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + { + "tensor": "unsqueeze_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_108", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_109", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_104" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_13", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_18", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_13" + }, + { + "tensor": "slice_108" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_156", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_18" + }, + { + "tensor": "unsqueeze_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_122", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_155" + }, + { + "tensor": "mul_156" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_157", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + { + "tensor": "unsqueeze_21" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_110", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_111", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_106" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_14", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_19", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_14" + }, + { + "tensor": "slice_110" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_158", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_19" + }, + { + "tensor": "unsqueeze_22" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_123", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_157" + }, + { + "tensor": "mul_158" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_20", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_122" + }, + { + "tensor": "slice_105" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_21", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_123" + }, + { + "tensor": "slice_107" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_4", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_22" + }, + { + "tensor": "cat_21" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_5", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_23" + }, + { + "tensor": "transpose_52" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_23", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_4" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_5", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_23" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_18", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_5" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_7", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_18" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_24", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_5" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_6", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_24" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_19", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_6" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_8", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_19" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_53", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_7" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_5", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_20" + }, + { + "tensor": "transpose_53" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_159", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_5" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_124", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_159" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_2", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_124" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_6", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_2" + }, + { + "tensor": "_unsafe_view_8" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_54", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_6" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_20", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_54" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_77", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_20" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_11", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_6" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_160", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_77" + }, + { + "tensor": "sigmoid_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_89", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_160" + }, + { + "tensor": "p_model_model_language_model_layers_11_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_125", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_115" + }, + { + "tensor": "linear_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_39", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_125" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_38", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_39" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_126", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_38" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_56", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_161", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_125" + }, + { + "tensor": "rsqrt_56" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_127", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_11_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_162", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_161" + }, + { + "tensor": "add_127" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_29", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_162" + }, + { + "tensor": "add_125" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_90", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_29" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_29", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_91", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_29" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_163", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_29" + }, + { + "tensor": "linear_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_92", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_163" + }, + { + "tensor": "p_model_model_language_model_layers_11_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_128", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_125" + }, + { + "tensor": "linear_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_40", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_128" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_39", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_40" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_129", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_39" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_57", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_164", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_128" + }, + { + "tensor": "rsqrt_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_130", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_165", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_164" + }, + { + "tensor": "add_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_30", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_165" + }, + { + "tensor": "add_128" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_93", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_55", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_93" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_94", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_78", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_94" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_95", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_96", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_30" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_22", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_24" + }, + { + "tensor": "transpose_55" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_112", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_22" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_9", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_25", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_9" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_9", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_22" + }, + { + "tensor": "unsqueeze_25" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_113", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_9" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_30", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_114", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_30" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_56", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_114" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_115", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_116", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_117", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_56" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_79", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_115" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_80", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_116" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_81", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_117" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_12", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_9", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_15", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_131", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_96" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_9", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_166", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_15" + }, + { + "tensor": "softplus_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_167", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_79" + }, + { + "tensor": "view_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_19", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_167" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_132", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_19" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_58", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_132" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_168", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_79" + }, + { + "tensor": "rsqrt_58" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_169", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_80" + }, + { + "tensor": "view_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_20", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_169" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_133", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_20" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_59", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_133" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_170", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_80" + }, + { + "tensor": "rsqrt_59" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_9", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_168" + }, + { + "tensor": "mul_170" + }, + { + "tensor": "view_81" + }, + { + "tensor": "mul_166" + }, + { + "tensor": "sigmoid_12" + }, + { + "tensor": "states_25" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_118", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_9" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_119", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_9" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_57", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_119" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_21", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_57" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_82", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_21" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_83", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_78" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_41", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_82" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_40", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_41" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_134", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_40" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_60", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_134" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_171", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_82" + }, + { + "tensor": "rsqrt_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_172", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_norm_weight" + }, + { + "tensor": "mul_171" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_31", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_173", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_172" + }, + { + "tensor": "silu_31" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_84", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_173" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_97", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_84" + }, + { + "tensor": "p_model_model_language_model_layers_12_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_135", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_128" + }, + { + "tensor": "linear_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_42", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_135" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_41", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_42" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_136", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_41" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_61", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_136" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_174", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_135" + }, + { + "tensor": "rsqrt_61" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_137", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_12_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_175", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_174" + }, + { + "tensor": "add_137" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_31", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_175" + }, + { + "tensor": "add_135" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_98", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_31" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_32", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_99", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_31" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_176", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_32" + }, + { + "tensor": "linear_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_100", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_176" + }, + { + "tensor": "p_model_model_language_model_layers_12_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_138", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_135" + }, + { + "tensor": "linear_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_43", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_138" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_42", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_43" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_139", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_42" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_62", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_177", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_138" + }, + { + "tensor": "rsqrt_62" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_140", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_178", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_177" + }, + { + "tensor": "add_140" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_32", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_178" + }, + { + "tensor": "add_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_101", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_58", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_101" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_102", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_85", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_102" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_103", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_104", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_32" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_23", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_26" + }, + { + "tensor": "transpose_58" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_120", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_23" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_10", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_26", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_10" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_10", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_23" + }, + { + "tensor": "unsqueeze_26" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_121", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_10" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_33", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_122", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_33" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_59", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_122" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_123", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_124", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_125", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_59" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_86", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_123" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_87", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_124" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_88", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_125" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_13", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_10", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_16", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_141", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_104" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_10", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_141" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_179", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_16" + }, + { + "tensor": "softplus_10" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_180", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_86" + }, + { + "tensor": "view_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_21", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_180" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_142", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_21" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_63", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_181", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_86" + }, + { + "tensor": "rsqrt_63" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_182", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_87" + }, + { + "tensor": "view_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_22", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_182" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_143", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_22" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_64", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_183", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_87" + }, + { + "tensor": "rsqrt_64" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_10", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_181" + }, + { + "tensor": "mul_183" + }, + { + "tensor": "view_88" + }, + { + "tensor": "mul_179" + }, + { + "tensor": "sigmoid_13" + }, + { + "tensor": "states_27" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_126", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_10" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_127", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_10" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_60", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_127" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_22", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_60" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_89", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_22" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_90", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_85" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_44", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_89" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_43", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_44" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_144", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_43" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_65", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_144" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_184", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_89" + }, + { + "tensor": "rsqrt_65" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_185", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_norm_weight" + }, + { + "tensor": "mul_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_34", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_186", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_185" + }, + { + "tensor": "silu_34" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_91", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_186" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_105", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_91" + }, + { + "tensor": "p_model_model_language_model_layers_13_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_145", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_138" + }, + { + "tensor": "linear_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_45", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_145" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_44", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_45" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_146", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_44" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_66", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_187", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_145" + }, + { + "tensor": "rsqrt_66" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_147", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_13_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_188", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_187" + }, + { + "tensor": "add_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_33", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_188" + }, + { + "tensor": "add_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_106", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_33" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_35", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_107", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_33" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_189", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_35" + }, + { + "tensor": "linear_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_108", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_189" + }, + { + "tensor": "p_model_model_language_model_layers_13_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_148", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_145" + }, + { + "tensor": "linear_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_46", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_148" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_45", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_46" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_149", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_45" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_67", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_149" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_190", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_148" + }, + { + "tensor": "rsqrt_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_150", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_191", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_190" + }, + { + "tensor": "add_150" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_34", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_191" + }, + { + "tensor": "add_148" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_109", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_61", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_109" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_110", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_92", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_110" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_111", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_112", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_34" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_24", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_28" + }, + { + "tensor": "transpose_61" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_128", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_24" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_11", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_27", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_11" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_11", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_24" + }, + { + "tensor": "unsqueeze_27" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_129", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_11" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_36", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_130", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_36" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_62", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_130" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_131", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_132", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_133", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_62" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_93", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_131" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_94", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_132" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_95", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_133" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_14", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_11", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_17", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_151", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_112" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_11", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_151" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_192", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_17" + }, + { + "tensor": "softplus_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_193", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_93" + }, + { + "tensor": "view_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_23", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_193" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_152", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_23" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_68", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_194", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_93" + }, + { + "tensor": "rsqrt_68" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_195", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_94" + }, + { + "tensor": "view_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_24", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_195" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_153", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_24" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_69", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_196", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_94" + }, + { + "tensor": "rsqrt_69" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_11", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_194" + }, + { + "tensor": "mul_196" + }, + { + "tensor": "view_95" + }, + { + "tensor": "mul_192" + }, + { + "tensor": "sigmoid_14" + }, + { + "tensor": "states_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_134", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_11" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_135", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_11" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_63", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_135" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_23", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_63" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_96", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_23" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_97", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_92" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_47", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_96" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_46", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_47" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_154", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_46" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_70", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_154" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_197", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_96" + }, + { + "tensor": "rsqrt_70" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_198", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_norm_weight" + }, + { + "tensor": "mul_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_37", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_199", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_198" + }, + { + "tensor": "silu_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_98", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_199" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_113", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_98" + }, + { + "tensor": "p_model_model_language_model_layers_14_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_155", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_148" + }, + { + "tensor": "linear_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_48", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_155" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_47", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_48" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_156", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_47" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_71", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_156" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_200", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_155" + }, + { + "tensor": "rsqrt_71" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_157", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_14_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_201", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_200" + }, + { + "tensor": "add_157" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_35", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_201" + }, + { + "tensor": "add_155" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_114", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_35" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_38", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_115", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_35" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_202", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_38" + }, + { + "tensor": "linear_115" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_116", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_202" + }, + { + "tensor": "p_model_model_language_model_layers_14_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_158", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_155" + }, + { + "tensor": "linear_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_49", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_158" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_48", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_49" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_159", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_48" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_72", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_159" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_203", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_158" + }, + { + "tensor": "rsqrt_72" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_160", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_204", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_203" + }, + { + "tensor": "add_160" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_36", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_204" + }, + { + "tensor": "add_158" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_117", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_99", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_117" + }, + [ + 1, + 64, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_136", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_99" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_137", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_99" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_24", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_137" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_9", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_24" + }, + [ + 1, + 64, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_100", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_136" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_50", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_100" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_49", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_50" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_161", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_49" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_73", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_161" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_205", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_100" + }, + { + "tensor": "rsqrt_73" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_162", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_206", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_205" + }, + { + "tensor": "add_162" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_37", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_206" + }, + { + "tensor": "view_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_64", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_37" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_118", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_101", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_118" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_51", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_101" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_50", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_51" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_163", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_50" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_74", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_163" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_207", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_101" + }, + { + "tensor": "rsqrt_74" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_164", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_208", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_207" + }, + { + "tensor": "add_164" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_38", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_208" + }, + { + "tensor": "view_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_65", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_38" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_119", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_36" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_102", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_119" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_66", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_102" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_28", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_29", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_138", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_64" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_139", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_64" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_140", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_65" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_141", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_65" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_209", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + { + "tensor": "unsqueeze_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_142", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_143", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_138" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_18", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_143" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_25", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_18" + }, + { + "tensor": "slice_142" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_210", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_25" + }, + { + "tensor": "unsqueeze_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_165", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_209" + }, + { + "tensor": "mul_210" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_211", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + { + "tensor": "unsqueeze_28" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_144", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_145", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_140" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_19", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_26", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_19" + }, + { + "tensor": "slice_144" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_212", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_26" + }, + { + "tensor": "unsqueeze_29" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_166", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_211" + }, + { + "tensor": "mul_212" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_27", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_165" + }, + { + "tensor": "slice_139" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_28", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_166" + }, + { + "tensor": "slice_141" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_6", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_30" + }, + { + "tensor": "cat_28" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_7", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_31" + }, + { + "tensor": "transpose_66" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_30", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_6" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_7", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_30" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_25", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_7" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_10", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_25" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_31", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_7" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_8", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_31" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_26", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_8" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_11", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_26" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_67", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_10" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_7", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_27" + }, + { + "tensor": "transpose_67" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_213", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_7" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_167", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_213" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_3", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_167" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_8", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_3" + }, + { + "tensor": "_unsafe_view_11" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_68", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_8" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_27", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_68" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_103", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_27" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_15", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_9" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_214", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_103" + }, + { + "tensor": "sigmoid_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_120", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_214" + }, + { + "tensor": "p_model_model_language_model_layers_15_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_168", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_158" + }, + { + "tensor": "linear_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_52", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_168" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_51", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_52" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_169", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_51" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_75", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_169" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_215", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_168" + }, + { + "tensor": "rsqrt_75" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_170", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_15_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_216", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_215" + }, + { + "tensor": "add_170" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_39", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_216" + }, + { + "tensor": "add_168" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_121", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_39" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_39", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_121" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_122", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_39" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_217", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_39" + }, + { + "tensor": "linear_122" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_123", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_217" + }, + { + "tensor": "p_model_model_language_model_layers_15_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_171", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_168" + }, + { + "tensor": "linear_123" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_53", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_171" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_52", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_53" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_172", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_52" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_76", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_172" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_218", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_171" + }, + { + "tensor": "rsqrt_76" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_173", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_219", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_218" + }, + { + "tensor": "add_173" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_40", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_219" + }, + { + "tensor": "add_171" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_124", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_69", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_124" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_125", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_104", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_125" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_126", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_127", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_40" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_29", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_32" + }, + { + "tensor": "transpose_69" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_146", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_29" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_12", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_32", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_12" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_12", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_29" + }, + { + "tensor": "unsqueeze_32" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_147", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_12" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_40", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_148", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_40" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_70", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_148" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_149", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_150", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_151", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_70" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_105", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_149" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_106", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_150" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_107", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_151" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_16", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_12", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_20", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_174", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_127" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_12", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_174" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_220", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_20" + }, + { + "tensor": "softplus_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_221", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_105" + }, + { + "tensor": "view_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_25", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_221" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_175", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_25" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_77", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_175" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_222", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_105" + }, + { + "tensor": "rsqrt_77" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_223", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_106" + }, + { + "tensor": "view_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_26", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_223" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_176", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_26" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_78", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_176" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_224", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_106" + }, + { + "tensor": "rsqrt_78" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_12", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_222" + }, + { + "tensor": "mul_224" + }, + { + "tensor": "view_107" + }, + { + "tensor": "mul_220" + }, + { + "tensor": "sigmoid_16" + }, + { + "tensor": "states_33" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_152", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_12" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_153", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_12" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_71", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_153" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_28", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_71" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_108", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_28" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_109", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_104" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_54", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_108" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_53", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_54" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_177", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_53" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_79", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_225", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_108" + }, + { + "tensor": "rsqrt_79" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_226", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_norm_weight" + }, + { + "tensor": "mul_225" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_41", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_227", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_226" + }, + { + "tensor": "silu_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_110", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_227" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_128", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_110" + }, + { + "tensor": "p_model_model_language_model_layers_16_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_178", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_171" + }, + { + "tensor": "linear_128" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_55", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_178" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_54", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_55" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_179", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_54" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_80", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_179" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_228", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_178" + }, + { + "tensor": "rsqrt_80" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_180", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_16_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_229", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_228" + }, + { + "tensor": "add_180" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_41", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_229" + }, + { + "tensor": "add_178" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_129", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_41" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_42", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_129" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_130", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_41" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_230", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_42" + }, + { + "tensor": "linear_130" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_131", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_230" + }, + { + "tensor": "p_model_model_language_model_layers_16_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_181", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_178" + }, + { + "tensor": "linear_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_56", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_181" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_55", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_56" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_182", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_55" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_81", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_182" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_231", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_181" + }, + { + "tensor": "rsqrt_81" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_183", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_232", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_231" + }, + { + "tensor": "add_183" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_42", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_232" + }, + { + "tensor": "add_181" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_132", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_72", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_132" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_133", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_111", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_133" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_134", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_135", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_42" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_30", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_34" + }, + { + "tensor": "transpose_72" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_154", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_30" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_13", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_33", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_13" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_13", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_30" + }, + { + "tensor": "unsqueeze_33" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_155", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_13" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_43", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_155" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_156", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_43" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_73", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_156" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_157", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_158", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_159", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_73" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_112", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_157" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_113", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_158" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_114", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_159" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_17", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_134" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_13", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_21", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_184", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_135" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_13", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_233", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_21" + }, + { + "tensor": "softplus_13" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_234", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_112" + }, + { + "tensor": "view_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_27", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_234" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_185", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_27" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_82", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_185" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_235", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_112" + }, + { + "tensor": "rsqrt_82" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_236", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_113" + }, + { + "tensor": "view_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_28", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_236" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_186", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_28" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_83", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_186" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_237", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_113" + }, + { + "tensor": "rsqrt_83" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_13", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_235" + }, + { + "tensor": "mul_237" + }, + { + "tensor": "view_114" + }, + { + "tensor": "mul_233" + }, + { + "tensor": "sigmoid_17" + }, + { + "tensor": "states_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_160", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_13" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_161", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_13" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_74", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_161" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_29", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_74" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_115", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_29" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_116", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_111" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_57", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_115" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_56", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_57" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_187", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_56" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_84", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_187" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_238", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_115" + }, + { + "tensor": "rsqrt_84" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_239", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_norm_weight" + }, + { + "tensor": "mul_238" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_44", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_116" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_240", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_239" + }, + { + "tensor": "silu_44" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_117", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_240" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_136", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_117" + }, + { + "tensor": "p_model_model_language_model_layers_17_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_188", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_181" + }, + { + "tensor": "linear_136" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_58", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_188" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_57", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_58" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_189", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_57" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_85", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_189" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_241", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_188" + }, + { + "tensor": "rsqrt_85" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_190", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_17_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_242", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_241" + }, + { + "tensor": "add_190" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_43", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_242" + }, + { + "tensor": "add_188" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_137", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_43" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_45", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_137" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_138", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_43" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_243", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_45" + }, + { + "tensor": "linear_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_139", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_243" + }, + { + "tensor": "p_model_model_language_model_layers_17_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_191", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_188" + }, + { + "tensor": "linear_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_59", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_191" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_58", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_59" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_192", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_58" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_86", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_192" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_244", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_191" + }, + { + "tensor": "rsqrt_86" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_193", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_245", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_244" + }, + { + "tensor": "add_193" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_44", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_245" + }, + { + "tensor": "add_191" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_140", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_75", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_140" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_141", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_118", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_141" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_142", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_143", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_44" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_31", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_36" + }, + { + "tensor": "transpose_75" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_162", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_31" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_14", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_34", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_14" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_14", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_31" + }, + { + "tensor": "unsqueeze_34" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_163", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_14" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_46", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_163" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_164", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_46" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_76", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_164" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_165", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_166", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_167", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_76" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_119", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_165" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_120", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_166" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_121", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_167" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_18", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_14", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_22", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_194", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_143" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_14", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_194" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_246", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_22" + }, + { + "tensor": "softplus_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_247", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_119" + }, + { + "tensor": "view_119" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_29", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_247" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_195", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_29" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_87", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_195" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_248", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_119" + }, + { + "tensor": "rsqrt_87" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_249", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_120" + }, + { + "tensor": "view_120" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_30", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_249" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_196", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_30" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_88", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_196" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_250", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_120" + }, + { + "tensor": "rsqrt_88" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_14", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_248" + }, + { + "tensor": "mul_250" + }, + { + "tensor": "view_121" + }, + { + "tensor": "mul_246" + }, + { + "tensor": "sigmoid_18" + }, + { + "tensor": "states_37" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_168", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_14" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_169", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_14" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_77", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_169" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_30", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_77" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_122", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_30" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_123", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_118" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_60", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_122" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_59", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_60" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_197", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_59" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_89", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_251", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_122" + }, + { + "tensor": "rsqrt_89" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_252", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_norm_weight" + }, + { + "tensor": "mul_251" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_47", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_123" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_253", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_252" + }, + { + "tensor": "silu_47" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_124", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_253" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_144", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_124" + }, + { + "tensor": "p_model_model_language_model_layers_18_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_198", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_191" + }, + { + "tensor": "linear_144" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_61", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_198" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_60", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_61" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_199", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_60" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_90", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_199" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_254", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_198" + }, + { + "tensor": "rsqrt_90" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_200", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_18_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_255", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_254" + }, + { + "tensor": "add_200" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_45", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_255" + }, + { + "tensor": "add_198" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_145", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_45" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_48", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_146", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_45" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_256", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_48" + }, + { + "tensor": "linear_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_147", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_256" + }, + { + "tensor": "p_model_model_language_model_layers_18_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_201", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_198" + }, + { + "tensor": "linear_147" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_62", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_201" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_61", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_62" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_202", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_61" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_91", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_202" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_257", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_201" + }, + { + "tensor": "rsqrt_91" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_203", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_258", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_257" + }, + { + "tensor": "add_203" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_46", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_258" + }, + { + "tensor": "add_201" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_148", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_125", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_148" + }, + [ + 1, + 64, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_170", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_125" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_171", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_125" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_31", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_171" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_12", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_31" + }, + [ + 1, + 64, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_126", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_170" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_63", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_126" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_62", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_63" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_204", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_62" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_92", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_204" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_259", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_126" + }, + { + "tensor": "rsqrt_92" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_205", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_260", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_259" + }, + { + "tensor": "add_205" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_47", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_260" + }, + { + "tensor": "view_126" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_78", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_47" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_149", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_127", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_149" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_64", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_127" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_63", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_64" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_206", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_63" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_93", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_206" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_261", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_127" + }, + { + "tensor": "rsqrt_93" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_207", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_262", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_261" + }, + { + "tensor": "add_207" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_48", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_262" + }, + { + "tensor": "view_127" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_79", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_48" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_150", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_46" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_128", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_150" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_80", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_128" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_35", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_36", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_172", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_78" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_173", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_78" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_174", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_79" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_175", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_79" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_263", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + { + "tensor": "unsqueeze_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_176", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_177", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_172" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_23", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_32", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_23" + }, + { + "tensor": "slice_176" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_264", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_32" + }, + { + "tensor": "unsqueeze_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_208", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_263" + }, + { + "tensor": "mul_264" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_265", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + { + "tensor": "unsqueeze_35" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_178", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_179", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_174" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_24", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_179" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_33", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_24" + }, + { + "tensor": "slice_178" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_266", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_33" + }, + { + "tensor": "unsqueeze_36" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_209", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_265" + }, + { + "tensor": "mul_266" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_34", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_208" + }, + { + "tensor": "slice_173" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_35", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_209" + }, + { + "tensor": "slice_175" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_8", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_38" + }, + { + "tensor": "cat_35" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_9", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_39" + }, + { + "tensor": "transpose_80" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_37", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_8" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_9", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_37" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_32", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_9" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_13", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_32" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_38", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_9" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_10", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_38" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_33", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_10" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_14", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_33" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_81", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_13" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_9", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_34" + }, + { + "tensor": "transpose_81" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_267", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_9" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_210", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_267" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_4", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_210" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_10", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_4" + }, + { + "tensor": "_unsafe_view_14" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_82", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_10" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_34", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_82" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_129", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_34" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_19", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_12" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_268", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_129" + }, + { + "tensor": "sigmoid_19" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_151", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_268" + }, + { + "tensor": "p_model_model_language_model_layers_19_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_211", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_201" + }, + { + "tensor": "linear_151" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_65", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_211" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_64", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_65" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_212", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_64" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_94", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_212" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_269", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_211" + }, + { + "tensor": "rsqrt_94" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_213", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_19_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_270", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_269" + }, + { + "tensor": "add_213" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_49", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_270" + }, + { + "tensor": "add_211" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_152", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_49" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_49", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_153", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_49" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_271", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_49" + }, + { + "tensor": "linear_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_154", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_271" + }, + { + "tensor": "p_model_model_language_model_layers_19_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_214", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_211" + }, + { + "tensor": "linear_154" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_66", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_214" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_65", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_66" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_215", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_65" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_95", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_215" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_272", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_214" + }, + { + "tensor": "rsqrt_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_216", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_273", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_272" + }, + { + "tensor": "add_216" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_50", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_273" + }, + { + "tensor": "add_214" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_155", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_83", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_155" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_156", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_130", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_156" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_157", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_158", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_50" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_36", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_40" + }, + { + "tensor": "transpose_83" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_180", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_36" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_15", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_39", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_15" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_15", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_36" + }, + { + "tensor": "unsqueeze_39" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_181", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_15" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_50", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_181" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_182", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_50" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_84", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_182" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_183", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_184", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_185", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_84" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_131", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_183" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_132", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_184" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_133", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_185" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_20", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_157" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_15", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_25", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_217", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_158" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_15", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_217" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_274", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_25" + }, + { + "tensor": "softplus_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_275", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_131" + }, + { + "tensor": "view_131" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_31", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_275" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_218", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_31" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_96", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_218" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_276", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_131" + }, + { + "tensor": "rsqrt_96" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_277", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_132" + }, + { + "tensor": "view_132" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_32", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_277" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_219", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_32" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_97", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_219" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_278", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_132" + }, + { + "tensor": "rsqrt_97" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_15", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_276" + }, + { + "tensor": "mul_278" + }, + { + "tensor": "view_133" + }, + { + "tensor": "mul_274" + }, + { + "tensor": "sigmoid_20" + }, + { + "tensor": "states_41" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_186", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_15" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_187", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_15" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_85", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_187" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_35", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_85" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_134", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_35" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_135", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_130" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_67", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_134" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_66", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_67" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_220", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_66" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_98", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_220" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_279", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_134" + }, + { + "tensor": "rsqrt_98" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_280", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_norm_weight" + }, + { + "tensor": "mul_279" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_51", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_135" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_281", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_280" + }, + { + "tensor": "silu_51" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_136", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_281" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_159", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_136" + }, + { + "tensor": "p_model_model_language_model_layers_20_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_221", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_214" + }, + { + "tensor": "linear_159" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_68", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_221" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_67", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_68" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_222", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_67" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_99", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_222" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_282", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_221" + }, + { + "tensor": "rsqrt_99" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_223", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_20_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_283", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_282" + }, + { + "tensor": "add_223" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_51", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_283" + }, + { + "tensor": "add_221" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_160", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_51" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_52", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_160" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_161", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_51" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_284", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_52" + }, + { + "tensor": "linear_161" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_162", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_284" + }, + { + "tensor": "p_model_model_language_model_layers_20_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_224", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_221" + }, + { + "tensor": "linear_162" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_69", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_224" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_68", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_69" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_225", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_68" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_100", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_225" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_285", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_224" + }, + { + "tensor": "rsqrt_100" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_226", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_286", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_285" + }, + { + "tensor": "add_226" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_52", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_286" + }, + { + "tensor": "add_224" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_163", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_86", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_163" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_164", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_137", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_164" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_165", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_166", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_52" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_37", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_42" + }, + { + "tensor": "transpose_86" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_188", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_37" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_16", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_40", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_16" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_16", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_37" + }, + { + "tensor": "unsqueeze_40" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_189", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_16" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_53", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_189" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_190", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_53" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_87", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_190" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_191", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_192", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_193", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_87" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_138", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_191" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_139", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_192" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_140", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_193" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_21", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_165" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_16", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_26", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_227", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_166" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_16", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_227" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_287", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_26" + }, + { + "tensor": "softplus_16" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_288", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_138" + }, + { + "tensor": "view_138" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_33", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_288" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_228", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_33" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_101", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_228" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_289", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_138" + }, + { + "tensor": "rsqrt_101" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_290", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_139" + }, + { + "tensor": "view_139" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_34", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_290" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_229", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_34" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_102", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_229" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_291", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_139" + }, + { + "tensor": "rsqrt_102" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_16", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_289" + }, + { + "tensor": "mul_291" + }, + { + "tensor": "view_140" + }, + { + "tensor": "mul_287" + }, + { + "tensor": "sigmoid_21" + }, + { + "tensor": "states_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_194", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_16" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_195", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_16" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_88", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_195" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_36", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_88" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_141", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_36" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_142", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_137" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_70", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_141" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_69", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_70" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_230", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_69" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_103", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_230" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_292", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_141" + }, + { + "tensor": "rsqrt_103" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_293", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_norm_weight" + }, + { + "tensor": "mul_292" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_54", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_142" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_294", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_293" + }, + { + "tensor": "silu_54" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_143", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_294" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_167", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_143" + }, + { + "tensor": "p_model_model_language_model_layers_21_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_231", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_224" + }, + { + "tensor": "linear_167" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_71", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_231" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_70", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_71" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_232", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_70" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_104", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_232" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_295", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_231" + }, + { + "tensor": "rsqrt_104" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_233", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_21_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_296", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_295" + }, + { + "tensor": "add_233" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_53", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_296" + }, + { + "tensor": "add_231" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_168", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_53" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_55", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_168" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_169", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_53" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_297", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_55" + }, + { + "tensor": "linear_169" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_170", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_297" + }, + { + "tensor": "p_model_model_language_model_layers_21_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_234", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_231" + }, + { + "tensor": "linear_170" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_72", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_234" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_71", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_72" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_235", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_71" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_105", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_235" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_298", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_234" + }, + { + "tensor": "rsqrt_105" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_236", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_299", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_298" + }, + { + "tensor": "add_236" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_54", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_299" + }, + { + "tensor": "add_234" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_171", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 448, in forward\n mixed_qkv = self.in_proj_qkv(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_89", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "linear_171" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 449, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_172", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 451, in forward\n z = self.in_proj_z(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_144", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_172" + }, + [ + 1, + 64, + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 452, in forward\n z = z.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_173", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 454, in forward\n b = self.in_proj_b(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_174", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_54" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 455, in forward\n a = self.in_proj_a(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_38", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "states_44" + }, + { + "tensor": "transpose_89" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 96, in update_conv_state\n combined = torch.cat([self.states[2 * layer_idx], value], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_196", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "cat_38" + }, + 2, + -4, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 469, in forward\n mixed_qkv = cache_params.update_conv_state(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 97, in update_conv_state\n self.states[2 * layer_idx] = combined[..., -conv_kernel_size:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "squeeze_17", + "op": "aten.squeeze.dim", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_conv1d_weight" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 475, in forward\n self.conv1d.weight.squeeze(1)," + }, + { + "id": "unsqueeze_41", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "squeeze_17" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 232, in causal_conv1d_fn\n weight=weight.unsqueeze(1),\n ^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "conv1d_17", + "op": "aten.conv1d.default", + "args": [ + { + "tensor": "cat_38" + }, + { + "tensor": "unsqueeze_41" + }, + null, + [ + 1 + ], + [ + 3 + ], + [ + 1 + ], + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "slice_197", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "conv1d_17" + }, + 2, + 0, + 68 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 230, in causal_conv1d_fn\n out = F.conv1d(\n ^^^^^^^^^" + }, + { + "id": "silu_56", + "op": "aten.silu.default", + "args": [ + { + "tensor": "slice_197" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 473, in forward\n mixed_qkv = causal_conv1d_fn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/hub_kernels.py\", line 861, in wrapped\n return implementation(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 238, in causal_conv1d_fn\n out = ACT2FN[activation](out)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_198", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "silu_56" + }, + 2, + -64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 483, in forward\n mixed_qkv = mixed_qkv[:, :, -seq_len:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_90", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_198" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 485, in forward\n mixed_qkv = mixed_qkv.transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_199", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 0, + 2048 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_200", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 2048, + 4096 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_201", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_90" + }, + -1, + 4096, + 6144 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 486, in forward\n query, key, value = torch.split(\n ^^^^^^^^^^^^" + }, + { + "id": "view_145", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_199" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 496, in forward\n query = query.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_146", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_200" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 497, in forward\n key = key.reshape(batch_size, seq_len, -1, self.head_k_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_147", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_201" + }, + [ + 1, + 64, + 16, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 498, in forward\n value = value.reshape(batch_size, seq_len, -1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_22", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "linear_173" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 500, in forward\n beta = b.sigmoid()\n ^^^^^^^^^^^" + }, + { + "id": "exp_17", + "op": "aten.exp.default", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_a_log" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_27", + "op": "aten.neg.default", + "args": [ + { + "tensor": "exp_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_237", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "linear_174" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_dt_bias" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softplus_17", + "op": "aten.softplus.default", + "args": [ + { + "tensor": "add_237" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_300", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "neg_27" + }, + { + "tensor": "softplus_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 502, in forward\n g = -self.A_log.float().exp() * F.softplus(a.float() + self.dt_bias)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_301", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_145" + }, + { + "tensor": "view_145" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_35", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_301" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_238", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_35" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_106", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_238" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_302", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_145" + }, + { + "tensor": "rsqrt_106" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 26, in _webtorch_chunk_gated_delta_rule\n query = l2norm(query, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "mul_303", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_146" + }, + { + "tensor": "view_146" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sum_36", + "op": "aten.sum.dim_IntList", + "args": [ + { + "tensor": "mul_303" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_239", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "sum_36" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_107", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_239" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 244, in l2norm\n inv_norm = torch.rsqrt((x * x).sum(dim=dim, keepdim=True) + eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_304", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_146" + }, + { + "tensor": "rsqrt_107" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 27, in _webtorch_chunk_gated_delta_rule\n key = l2norm(key, dim=-1, eps=1e-6)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 245, in l2norm\n return x * inv_norm\n ^^^^^^^^^^^^" + }, + { + "id": "normalized_gated_delta_rule_17", + "op": "webtorch.normalized_gated_delta_rule.default", + "args": [ + { + "tensor": "mul_302" + }, + { + "tensor": "mul_304" + }, + { + "tensor": "view_147" + }, + { + "tensor": "mul_300" + }, + { + "tensor": "sigmoid_22" + }, + { + "tensor": "states_45" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 28, in _webtorch_chunk_gated_delta_rule\n packed = normalized_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_202", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_17" + }, + 2, + 0, + 128 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 32, in _webtorch_chunk_gated_delta_rule\n final_state = packed[:, :, :key_width]\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_203", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "normalized_gated_delta_rule_17" + }, + 2, + 128, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_91", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "slice_203" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_37", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_91" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 522, in forward\n core_attn_out, last_recurrent_state = torch_chunk_gated_delta_rule(\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 33, in _webtorch_chunk_gated_delta_rule\n output = packed[:, :, key_width:].transpose(1, 2).contiguous().to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_148", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_37" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 540, in forward\n core_attn_out = core_attn_out.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_149", + "op": "aten.view.default", + "args": [ + { + "tensor": "view_144" + }, + [ + -1, + 128 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 541, in forward\n z = z.reshape(-1, self.head_v_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_73", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_148" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_72", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_73" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 178, in forward\n variance = hidden_states.pow(2).mean(-1, keepdim=True)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_240", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_72" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_108", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_240" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_305", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_148" + }, + { + "tensor": "rsqrt_108" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 180, in forward\n hidden_states = hidden_states * torch.rsqrt(variance + self.variance_epsilon)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_306", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_norm_weight" + }, + { + "tensor": "mul_305" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 181, in forward\n hidden_states = self.weight * hidden_states.to(input_dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_57", + "op": "aten.silu.default", + "args": [ + { + "tensor": "view_149" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_307", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_306" + }, + { + "tensor": "silu_57" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 542, in forward\n core_attn_out = self.norm(core_attn_out, z)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 182, in forward\n hidden_states = hidden_states * ACT2FN[self.activation](gate.to(torch.float32))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_150", + "op": "aten.view.default", + "args": [ + { + "tensor": "mul_307" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 543, in forward\n core_attn_out = core_attn_out.reshape(batch_size, seq_len, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_175", + "op": "aten.linear.default", + "args": [ + { + "tensor": "view_150" + }, + { + "tensor": "p_model_model_language_model_layers_22_linear_attn_out_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 771, in forward\n hidden_states = self.linear_attn(\n ^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/integrations/accelerate.py\", line 1010, in wrapped\n output = forward_func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 545, in forward\n output = self.out_proj(core_attn_out)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_241", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_234" + }, + { + "tensor": "linear_175" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_74", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_241" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_73", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_74" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_242", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_73" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_109", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_242" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_308", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_241" + }, + { + "tensor": "rsqrt_109" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_243", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_22_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_309", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_308" + }, + { + "tensor": "add_243" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_55", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_309" + }, + { + "tensor": "add_241" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_176", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_55" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_58", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_176" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_177", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_55" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_310", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_58" + }, + { + "tensor": "linear_177" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_178", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_310" + }, + { + "tensor": "p_model_model_language_model_layers_22_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_244", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_241" + }, + { + "tensor": "linear_178" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_75", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_244" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_74", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_75" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_245", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_74" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_110", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_245" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_311", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_244" + }, + { + "tensor": "rsqrt_110" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_246", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_input_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_312", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_311" + }, + { + "tensor": "add_246" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_56", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_312" + }, + { + "tensor": "add_244" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 767, in forward\n hidden_states = self.input_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_179", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_q_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "view_151", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_179" + }, + [ + 1, + 64, + -1, + 512 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 671, in forward\n self.q_proj(hidden_states).view(*input_shape, -1, self.head_dim * 2), 2, dim=-1" + }, + { + "id": "slice_204", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_151" + }, + -1, + 0, + 256 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "slice_205", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "view_151" + }, + -1, + 256, + 512 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 670, in forward\n query_states, gate = torch.chunk(\n ^^^^^^^^^^^^" + }, + { + "id": "clone_38", + "op": "aten.clone.default", + "args": [ + { + "tensor": "slice_205" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_15", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_38" + }, + [ + 1, + 64, + 2048 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 673, in forward\n gate = gate.reshape(*input_shape, -1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_152", + "op": "aten.view.default", + "args": [ + { + "tensor": "slice_204" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_76", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_152" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_75", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_76" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_247", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_75" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_111", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_247" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_313", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_152" + }, + { + "tensor": "rsqrt_111" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_248", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_self_attn_q_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_314", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_313" + }, + { + "tensor": "add_248" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_57", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_314" + }, + { + "tensor": "view_152" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_92", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_57" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 675, in forward\n query_states = self.q_norm(query_states.view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_180", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_k_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_153", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_180" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_77", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "view_153" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_76", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_77" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_249", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_76" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_112", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_249" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_315", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_153" + }, + { + "tensor": "rsqrt_112" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_250", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_self_attn_k_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_316", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_315" + }, + { + "tensor": "add_250" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_58", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_316" + }, + { + "tensor": "view_153" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_93", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "type_as_58" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 676, in forward\n key_states = self.k_norm(self.k_proj(hidden_states).view(hidden_shape)).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_181", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_56" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_v_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_154", + "op": "aten.view.default", + "args": [ + { + "tensor": "linear_181" + }, + [ + 1, + 64, + -1, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_94", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "view_154" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 677, in forward\n value_states = self.v_proj(hidden_states).view(hidden_shape).transpose(1, 2)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_42", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 577, in apply_rotary_pos_emb\n cos = cos.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_43", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "mul_1" + }, + 1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 578, in apply_rotary_pos_emb\n sin = sin.unsqueeze(unsqueeze_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_206", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_92" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_207", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_92" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 582, in apply_rotary_pos_emb\n q_rot, q_pass = q[..., :rotary_dim], q[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_208", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_93" + }, + 3, + 0, + 64 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_209", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "transpose_93" + }, + 3, + 64, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 583, in apply_rotary_pos_emb\n k_rot, k_pass = k[..., :rotary_dim], k[..., rotary_dim:]\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_317", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + { + "tensor": "unsqueeze_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_210", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_211", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_206" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_28", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_211" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_39", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_28" + }, + { + "tensor": "slice_210" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_318", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_39" + }, + { + "tensor": "unsqueeze_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_251", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_317" + }, + { + "tensor": "mul_318" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 586, in apply_rotary_pos_emb\n q_embed = (q_rot * cos) + (rotate_half(q_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_319", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + { + "tensor": "unsqueeze_42" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_212", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + 3, + 0, + 32 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 551, in rotate_half\n x1 = x[..., : x.shape[-1] // 2]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "slice_213", + "op": "aten.slice.Tensor", + "args": [ + { + "tensor": "slice_208" + }, + 3, + 32, + 9223372036854775807 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 552, in rotate_half\n x2 = x[..., x.shape[-1] // 2 :]\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "neg_29", + "op": "aten.neg.default", + "args": [ + { + "tensor": "slice_213" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_40", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "neg_29" + }, + { + "tensor": "slice_212" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 553, in rotate_half\n return torch.cat((-x2, x1), dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_320", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "cat_40" + }, + { + "tensor": "unsqueeze_43" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_252", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_319" + }, + { + "tensor": "mul_320" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 587, in apply_rotary_pos_emb\n k_embed = (k_rot * cos) + (rotate_half(k_rot) * sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_41", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_251" + }, + { + "tensor": "slice_207" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 590, in apply_rotary_pos_emb\n q_embed = torch.cat([q_embed, q_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cat_42", + "op": "aten.cat.default", + "args": [ + [ + { + "tensor": "add_252" + }, + { + "tensor": "slice_209" + } + ], + -1 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 680, in forward\n query_states, key_states = apply_rotary_pos_emb(query_states, key_states, cos, sin)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 591, in apply_rotary_pos_emb\n k_embed = torch.cat([k_embed, k_pass], dim=-1)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_10", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_46" + }, + { + "tensor": "cat_42" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 91, in update\n self.states[2 * layer_idx] = cache_update(self.states[2 * layer_idx], key, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "cache_update_11", + "op": "webtorch.cache_update.default", + "args": [ + { + "tensor": "states_47" + }, + { + "tensor": "transpose_94" + }, + { + "tensor": "cache_position" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 683, in forward\n key_states, value_states = past_key_values.update(key_states, value_states, self.layer_idx)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 92, in update\n self.states[2 * layer_idx + 1] = cache_update(self.states[2 * layer_idx + 1], value, self.positions)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_44", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_10" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_11", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_44" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_39", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_11" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_16", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_39" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 617, in eager_attention_forward\n key_states = repeat_kv(key, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "unsqueeze_45", + "op": "aten.unsqueeze.default", + "args": [ + { + "tensor": "cache_update_11" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "expand_12", + "op": "aten.expand.default", + "args": [ + { + "tensor": "unsqueeze_45" + }, + [ + 1, + 2, + 4, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 603, in repeat_kv\n hidden_states = hidden_states[:, :, None, :, :].expand(batch, num_key_value_heads, n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_40", + "op": "aten.clone.default", + "args": [ + { + "tensor": "expand_12" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "_unsafe_view_17", + "op": "aten._unsafe_view.default", + "args": [ + { + "tensor": "clone_40" + }, + [ + 1, + 8, + 4096, + 256 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 618, in eager_attention_forward\n value_states = repeat_kv(value, module.num_key_value_groups)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 604, in repeat_kv\n return hidden_states.reshape(batch, num_key_value_heads * n_rep, slen, head_dim)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_95", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "_unsafe_view_16" + }, + 2, + 3 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_11", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "cat_41" + }, + { + "tensor": "transpose_95" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_321", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "matmul_11" + }, + 0.0625 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 620, in eager_attention_forward\n attn_weights = torch.matmul(query, key_states.transpose(2, 3)) * scaling\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_253", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mul_321" + }, + { + "tensor": "attention_mask" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 622, in eager_attention_forward\n attn_weights = attn_weights + attention_mask\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "softmax_5", + "op": "aten.softmax.int", + "args": [ + { + "tensor": "add_253" + }, + -1, + { + "dtype": "float32" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 624, in eager_attention_forward\n attn_weights = nn.functional.softmax(attn_weights, dim=-1, dtype=torch.float32).to(query.dtype)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "matmul_12", + "op": "aten.matmul.default", + "args": [ + { + "tensor": "softmax_5" + }, + { + "tensor": "_unsafe_view_17" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 626, in eager_attention_forward\n attn_output = torch.matmul(attn_weights, value_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "transpose_96", + "op": "aten.transpose.int", + "args": [ + { + "tensor": "matmul_12" + }, + 1, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "clone_41", + "op": "aten.clone.default", + "args": [ + { + "tensor": "transpose_96" + } + ], + "kwargs": { + "memory_format": { + "memoryFormat": "contiguous_format" + } + }, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 689, in forward\n attn_output, attn_weights = attention_interface(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 627, in eager_attention_forward\n attn_output = attn_output.transpose(1, 2).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "view_155", + "op": "aten.view.default", + "args": [ + { + "tensor": "clone_41" + }, + [ + 1, + 64, + -1 + ] + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 700, in forward\n attn_output = attn_output.reshape(*input_shape, -1).contiguous()\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "sigmoid_23", + "op": "aten.sigmoid.default", + "args": [ + { + "tensor": "_unsafe_view_15" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_322", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "view_155" + }, + { + "tensor": "sigmoid_23" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 701, in forward\n attn_output = attn_output * torch.sigmoid(gate)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_182", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_322" + }, + { + "tensor": "p_model_model_language_model_layers_23_self_attn_o_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 779, in forward\n hidden_states, _ = self.self_attn(\n ^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 703, in forward\n attn_output = self.o_proj(attn_output)\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_254", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_244" + }, + { + "tensor": "linear_182" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 788, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_78", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_254" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_77", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_78" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_255", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_77" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_113", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_255" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_323", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_254" + }, + { + "tensor": "rsqrt_113" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_256", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_layers_23_post_attention_layernorm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_324", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_323" + }, + { + "tensor": "add_256" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_59", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_324" + }, + { + "tensor": "add_254" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 792, in forward\n hidden_states = self.post_attention_layernorm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_183", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_59" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_gate_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "silu_59", + "op": "aten.silu.default", + "args": [ + { + "tensor": "linear_183" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/activations.py\", line 103, in forward\n return nn.functional.silu(input)\n ^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_184", + "op": "aten.linear.default", + "args": [ + { + "tensor": "type_as_59" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_up_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_325", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "silu_59" + }, + { + "tensor": "linear_184" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_185", + "op": "aten.linear.default", + "args": [ + { + "tensor": "mul_325" + }, + { + "tensor": "p_model_model_language_model_layers_23_mlp_down_proj_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 793, in forward\n hidden_states = self.mlp(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 719, in forward\n down_proj = self.down_proj(self.act_fn(self.gate_proj(x)) * self.up_proj(x))\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_257", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "add_254" + }, + { + "tensor": "linear_185" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1206, in forward\n hidden_states = decoder_layer(\n ^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/modeling_layers.py\", line 114, in __call__\n return super().__call__(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 794, in forward\n hidden_states = residual + hidden_states\n ^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "pow_79", + "op": "aten.pow.Tensor_Scalar", + "args": [ + { + "tensor": "add_257" + }, + 2 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mean_78", + "op": "aten.mean.dim", + "args": [ + { + "tensor": "pow_79" + }, + [ + -1 + ], + true + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_258", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "mean_78" + }, + 1e-06 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "rsqrt_114", + "op": "aten.rsqrt.default", + "args": [ + { + "tensor": "add_258" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_326", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "add_257" + }, + { + "tensor": "rsqrt_114" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 733, in forward\n output = self._norm(x.float())\n ^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 730, in _norm\n return x * torch.rsqrt(x.pow(2).mean(-1, keepdim=True) + self.eps)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "add_259", + "op": "aten.add.Tensor", + "args": [ + { + "tensor": "p_model_model_language_model_norm_weight" + }, + 1.0 + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "mul_327", + "op": "aten.mul.Tensor", + "args": [ + { + "tensor": "mul_326" + }, + { + "tensor": "add_259" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 736, in forward\n output = output * (1.0 + self.weight.float())\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "type_as_60", + "op": "aten.type_as.default", + "args": [ + { + "tensor": "mul_327" + }, + { + "tensor": "add_257" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1769, in forward\n outputs = self.model(\n ^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1562, in forward\n outputs = self.language_model(\n ^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 1068, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/output_capturing.py\", line 262, in wrapper\n outputs = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1216, in forward\n hidden_states = self.norm(hidden_states)\n ^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 737, in forward\n return output.type_as(x)\n ^^^^^^^^^^^^^^^^^" + }, + { + "id": "alias", + "op": "aten.alias.default", + "args": [ + { + "tensor": "type_as_60" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1787, in forward\n logits = self.lm_head(hidden_states[:, slice_indices, :])\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + }, + { + "id": "linear_186", + "op": "aten.linear.default", + "args": [ + { + "tensor": "alias" + }, + { + "tensor": "p_model_model_language_model_embed_tokens_weight" + } + ], + "kwargs": {}, + "source": "File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/torch/_dynamo/functional_export.py\", line 243, in forward\n res = self._export_root(*args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 178, in forward\n return super().forward(input_ids, position_ids, attention_mask, image_embedding, is_image,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/python/webtorch/adapters/qwen35.py\", line 149, in forward\n output = self.model(inputs_embeds=embedding, position_ids=position_ids,\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/utils/generic.py\", line 939, in wrapper\n output = func(self, *args, **kwargs)\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^\n File \"/Users/reserve/Workspace/webtorch/.venv/lib/python3.11/site-packages/transformers/models/qwen3_5/modeling_qwen3_5.py\", line 1787, in forward\n logits = self.lm_head(hidden_states[:, slice_indices, :])\n ^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^^" + } + ], + "quantization": [], + "states": [ + { + "input": "states_0", + "output": "slice_10", + "kind": "convolution" + }, + { + "input": "states_1", + "output": "slice_16", + "kind": "recurrent" + }, + { + "input": "states_2", + "output": "slice_18", + "kind": "convolution" + }, + { + "input": "states_3", + "output": "slice_24", + "kind": "recurrent" + }, + { + "input": "states_4", + "output": "slice_26", + "kind": "convolution" + }, + { + "input": "states_5", + "output": "slice_32", + "kind": "recurrent" + }, + { + "input": "states_6", + "output": "cache_update", + "kind": "kv" + }, + { + "input": "states_7", + "output": "cache_update_1", + "kind": "kv" + }, + { + "input": "states_8", + "output": "slice_44", + "kind": "convolution" + }, + { + "input": "states_9", + "output": "slice_50", + "kind": "recurrent" + }, + { + "input": "states_10", + "output": "slice_52", + "kind": "convolution" + }, + { + "input": "states_11", + "output": "slice_58", + "kind": "recurrent" + }, + { + "input": "states_12", + "output": "slice_60", + "kind": "convolution" + }, + { + "input": "states_13", + "output": "slice_66", + "kind": "recurrent" + }, + { + "input": "states_14", + "output": "cache_update_2", + "kind": "kv" + }, + { + "input": "states_15", + "output": "cache_update_3", + "kind": "kv" + }, + { + "input": "states_16", + "output": "slice_78", + "kind": "convolution" + }, + { + "input": "states_17", + "output": "slice_84", + "kind": "recurrent" + }, + { + "input": "states_18", + "output": "slice_86", + "kind": "convolution" + }, + { + "input": "states_19", + "output": "slice_92", + "kind": "recurrent" + }, + { + "input": "states_20", + "output": "slice_94", + "kind": "convolution" + }, + { + "input": "states_21", + "output": "slice_100", + "kind": "recurrent" + }, + { + "input": "states_22", + "output": "cache_update_4", + "kind": "kv" + }, + { + "input": "states_23", + "output": "cache_update_5", + "kind": "kv" + }, + { + "input": "states_24", + "output": "slice_112", + "kind": "convolution" + }, + { + "input": "states_25", + "output": "slice_118", + "kind": "recurrent" + }, + { + "input": "states_26", + "output": "slice_120", + "kind": "convolution" + }, + { + "input": "states_27", + "output": "slice_126", + "kind": "recurrent" + }, + { + "input": "states_28", + "output": "slice_128", + "kind": "convolution" + }, + { + "input": "states_29", + "output": "slice_134", + "kind": "recurrent" + }, + { + "input": "states_30", + "output": "cache_update_6", + "kind": "kv" + }, + { + "input": "states_31", + "output": "cache_update_7", + "kind": "kv" + }, + { + "input": "states_32", + "output": "slice_146", + "kind": "convolution" + }, + { + "input": "states_33", + "output": "slice_152", + "kind": "recurrent" + }, + { + "input": "states_34", + "output": "slice_154", + "kind": "convolution" + }, + { + "input": "states_35", + "output": "slice_160", + "kind": "recurrent" + }, + { + "input": "states_36", + "output": "slice_162", + "kind": "convolution" + }, + { + "input": "states_37", + "output": "slice_168", + "kind": "recurrent" + }, + { + "input": "states_38", + "output": "cache_update_8", + "kind": "kv" + }, + { + "input": "states_39", + "output": "cache_update_9", + "kind": "kv" + }, + { + "input": "states_40", + "output": "slice_180", + "kind": "convolution" + }, + { + "input": "states_41", + "output": "slice_186", + "kind": "recurrent" + }, + { + "input": "states_42", + "output": "slice_188", + "kind": "convolution" + }, + { + "input": "states_43", + "output": "slice_194", + "kind": "recurrent" + }, + { + "input": "states_44", + "output": "slice_196", + "kind": "convolution" + }, + { + "input": "states_45", + "output": "slice_202", + "kind": "recurrent" + }, + { + "input": "states_46", + "output": "cache_update_10", + "kind": "kv" + }, + { + "input": "states_47", + "output": "cache_update_11", + "kind": "kv" + } + ], + "dispatches": [ + { + "node": "embedding__part_0", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_0_32768" + ], + "output": "embedding__part_0", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ffd61bbf56bbbbf8d09f9d601173f529b4c4039901ae92ddbbbf3aab411547a1.wgsl" + }, + { + "node": "embedding__part_1", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768" + ], + "output": "embedding__part_1", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/62708aacbfcd0063a897e3348ae69a00d4dd155fce6665b18c5176224b039e12.wgsl" + }, + { + "node": "embedding__part_2", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768" + ], + "output": "embedding__part_2", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8485c3edc4d8013903fedc22091c7530a69a97da8b3dbd0cc5c55f54220709fb.wgsl" + }, + { + "node": "embedding__part_3", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768" + ], + "output": "embedding__part_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/b1741cc45db17fa6e66bd797a89a3e3ca7cc70854e55c9e549d4f8500ef5a509.wgsl" + }, + { + "node": "embedding__part_4", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768" + ], + "output": "embedding__part_4", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f27100b1e707c866f7cdd701f722bed2969be6e71245d4e4a14e1ef7ebe3fcf.wgsl" + }, + { + "node": "embedding__part_5", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768" + ], + "output": "embedding__part_5", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/0fa78dd7a41f9816e0a051fa3076f0ee2d258ff73d4e66a1360a492cb2e924d6.wgsl" + }, + { + "node": "embedding__part_6", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768" + ], + "output": "embedding__part_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a21dc37cea5d4adc26465d78d5491b794129ded665b3b3c014438c11519a837c.wgsl" + }, + { + "node": "embedding__part_7", + "inputs": [ + "input_ids", + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944" + ], + "output": "embedding__part_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/2927b33e105f6ccb9c4352ebdf028ea856d0f47c23a7f6cb140d5acb45356c35.wgsl" + }, + { + "node": "embedding__sum_0", + "inputs": [ + "embedding__part_0", + "embedding__part_1" + ], + "output": "embedding__sum_0", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "embedding__sum_1", + "inputs": [ + "embedding__sum_0", + "embedding__part_2" + ], + "output": "embedding__sum_1", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "embedding__sum_2", + "inputs": [ + "embedding__sum_1", + "embedding__part_3" + ], + "output": "embedding__sum_2", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "embedding__sum_3", + "inputs": [ + "embedding__sum_2", + "embedding__part_4" + ], + "output": "embedding__sum_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "embedding__sum_4", + "inputs": [ + "embedding__sum_3", + "embedding__part_5" + ], + "output": "embedding__sum_4", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "embedding__sum_5", + "inputs": [ + "embedding__sum_4", + "embedding__part_6" + ], + "output": "embedding__sum_5", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "embedding", + "inputs": [ + "embedding__sum_5", + "embedding__part_7" + ], + "output": "embedding", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "where", + "inputs": [ + "embedding", + "image_embedding", + "is_image" + ], + "output": "where", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/62241f9af7edde53e203819e23574a91664aff7282197113c8fee316f6c2af8f.wgsl" + }, + { + "node": "slice_1", + "inputs": [ + "position_ids" + ], + "output": "slice_1", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/71d38690bcc7fc30f01f1c8fa2f13a38beff889fcb3ff387861bb70038e92129.wgsl" + }, + { + "node": "unsqueeze", + "inputs": [ + "b_model_model_language_model_rotary_emb_inv_freq" + ], + "output": "unsqueeze", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "unsqueeze_1", + "inputs": [ + "unsqueeze" + ], + "output": "unsqueeze_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "unsqueeze_2", + "inputs": [ + "unsqueeze_1" + ], + "output": "unsqueeze_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/c72041e82befee6919af48775291256e22a43dc6445ef0aa288db6b96585a2a9.wgsl" + }, + { + "node": "expand", + "inputs": [ + "unsqueeze_2" + ], + "output": "expand", + "workgroups": [ + 2, + 1, + 1 + ], + "kernel": "kernels/a77f14c89662d2d3da8abd8f109667793dc662d307e5e1c61123be753e25437b.wgsl" + }, + { + "node": "unsqueeze_3", + "inputs": [ + "slice_1" + ], + "output": "unsqueeze_3", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/b3c44f5f11a5fcc5c32ce6a1167f2b1232839113872306dcd7023ad9fe385c29.wgsl" + }, + { + "node": "_to_copy", + "inputs": [ + "unsqueeze_3" + ], + "output": "_to_copy", + "workgroups": [ + 3, + 1, + 1 + ], + "kernel": "kernels/da7c63a84d7f2c46e8234a34c0905cfad6229740145070df00819509f8ab39de.wgsl" + }, + { + "node": "matmul", + "inputs": [ + "expand", + "_to_copy" + ], + "output": "matmul", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/dd544e5a005b68617e9a3557e1d24dd6282a5a62f47cae4cc41b619d3a1cd603.wgsl" + }, + { + "node": "transpose", + "inputs": [ + "matmul" + ], + "output": "transpose", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl" + }, + { + "node": "select", + "inputs": [ + "transpose" + ], + "output": "select", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl" + }, + { + "node": "select_1", + "inputs": [ + "transpose" + ], + "output": "select_1", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/f5f6f056866d42771d34664166a72300424224e9d6bd1d57de1805e7476a2050.wgsl" + }, + { + "node": "slice_2", + "inputs": [ + "select_1" + ], + "output": "slice_2", + "workgroups": [ + 11, + 1, + 1 + ], + "kernel": "kernels/efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b.wgsl" + }, + { + "node": "slice_3", + "inputs": [ + "select" + ], + "output": "slice_3", + "workgroups": [ + 11, + 1, + 1 + ], + "kernel": "kernels/efcecdf33b6927a4add3f254d95cad6d18d755d65e3f4873e8b7f5c057646a9b.wgsl" + }, + { + "node": "copy", + "inputs": [ + "slice_2" + ], + "output": "copy", + "workgroups": [ + 11, + 1, + 1 + ], + "kernel": "kernels/48608b2b7bfbe0b65d9e2d82a94a76683315421acb1bf168b4baf14a3c139f76.wgsl" + }, + { + "node": "transpose_1", + "inputs": [ + "matmul" + ], + "output": "transpose_1", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl" + }, + { + "node": "select_2", + "inputs": [ + "transpose_1" + ], + "output": "select_2", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl" + }, + { + "node": "slice_scatter", + "inputs": [ + "copy", + "select_2" + ], + "output": "slice_scatter", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/9f040facf0594804dba5b0f10f53b11b7223a1e1705896f95a8f95aa0fff5eec.wgsl" + }, + { + "node": "select_scatter", + "inputs": [ + "slice_scatter", + "transpose_1" + ], + "output": "select_scatter", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91.wgsl" + }, + { + "node": "transpose_2", + "inputs": [ + "select_scatter" + ], + "output": "transpose_2", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992.wgsl" + }, + { + "node": "transpose_7", + "inputs": [ + "transpose_2" + ], + "output": "transpose_7", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl" + }, + { + "node": "select_7", + "inputs": [ + "transpose_7" + ], + "output": "select_7", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl" + }, + { + "node": "slice_7", + "inputs": [ + "select_7" + ], + "output": "slice_7", + "workgroups": [ + 10, + 1, + 1 + ], + "kernel": "kernels/fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb.wgsl" + }, + { + "node": "transpose_8", + "inputs": [ + "transpose_2" + ], + "output": "transpose_8", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl" + }, + { + "node": "select_8", + "inputs": [ + "transpose_8" + ], + "output": "select_8", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/c83a2a6faf563ec3bbad43a3e108d58c09cd8aeed01b38e4e82d1c3c9b650c21.wgsl" + }, + { + "node": "slice_8", + "inputs": [ + "select_8" + ], + "output": "slice_8", + "workgroups": [ + 10, + 1, + 1 + ], + "kernel": "kernels/fb200142bcbd435ed588a9fc45924edb21845ff3ab0ddb0271c5d5d03adf04bb.wgsl" + }, + { + "node": "copy_1", + "inputs": [ + "slice_8" + ], + "output": "copy_1", + "workgroups": [ + 10, + 1, + 1 + ], + "kernel": "kernels/56167a7e8fb1c67fa72948a8baa71866d54cc775be83f8cfa75a947ac0f58b12.wgsl" + }, + { + "node": "transpose_9", + "inputs": [ + "transpose_2" + ], + "output": "transpose_9", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl" + }, + { + "node": "select_9", + "inputs": [ + "transpose_9" + ], + "output": "select_9", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl" + }, + { + "node": "slice_scatter_1", + "inputs": [ + "copy_1", + "select_9" + ], + "output": "slice_scatter_1", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/b3bb2905555188f535b6b8bc1d050c142b5fea8222d9ef193466f80aa2c54dea.wgsl" + }, + { + "node": "select_scatter_1", + "inputs": [ + "slice_scatter_1", + "transpose_9" + ], + "output": "select_scatter_1", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/691af757595593839af5e5e97ee656472f6e7c7406f57d1d9faae74816d9fc91.wgsl" + }, + { + "node": "transpose_10", + "inputs": [ + "select_scatter_1" + ], + "output": "transpose_10", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992.wgsl" + }, + { + "node": "transpose_12", + "inputs": [ + "transpose_10" + ], + "output": "transpose_12", + "workgroups": [ + 96, + 1, + 1 + ], + "kernel": "kernels/84101fc314579b90d71da4cca3a2c2cdc2074d96d2861c4b8e38c22cc1903138.wgsl" + }, + { + "node": "select_11", + "inputs": [ + "transpose_12" + ], + "output": "select_11", + "workgroups": [ + 32, + 1, + 1 + ], + "kernel": "kernels/d8757289e027d60366190dda56db53f6d6a3358fd813e84ca58f2076ddb0bf3e.wgsl" + }, + { + "node": "cat", + "inputs": [ + "select_11" + ], + "output": "cat", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/0337d8a473b6e485bd383533df7d373dbbfe7a5f3a982424004560b7213fbaa3.wgsl" + }, + { + "node": "cos", + "inputs": [ + "cat" + ], + "output": "cos", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7adea2b745b20a2abb96d02a1fca6db5f06f3c5aac850cf8ae1afa6f50868ded.wgsl" + }, + { + "node": "mul", + "inputs": [ + "cos" + ], + "output": "mul", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/2b9e4b05ef5623d721dbe56b5812e551efcc6fd833d81064320e86fe94d8c670.wgsl" + }, + { + "node": "sin", + "inputs": [ + "cat" + ], + "output": "sin", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/28119aa01122c42bd26ceb37129fe0c95b2a9192163f6dabd90fe058b1e14c54.wgsl" + }, + { + "node": "mul_1", + "inputs": [ + "sin" + ], + "output": "mul_1", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/2b9e4b05ef5623d721dbe56b5812e551efcc6fd833d81064320e86fe94d8c670.wgsl" + }, + { + "node": "mul_3", + "inputs": [ + "where", + "p_model_model_language_model_layers_0_input_layernorm_weight" + ], + "output": "mul_3", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as", + "inputs": [ + "mul_3" + ], + "output": "type_as", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight" + ], + "output": "linear", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_13", + "inputs": [ + "linear" + ], + "output": "transpose_13", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_1", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight" + ], + "output": "linear_1", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view", + "inputs": [ + "linear_1" + ], + "output": "view", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_2", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight" + ], + "output": "linear_2", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_3", + "inputs": [ + "type_as", + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight" + ], + "output": "linear_3", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_1", + "inputs": [ + "states_0", + "transpose_13" + ], + "output": "cat_1", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_10", + "inputs": [ + "cat_1" + ], + "output": "slice_10", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_0", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze", + "inputs": [ + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight" + ], + "output": "squeeze", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_4", + "inputs": [ + "squeeze" + ], + "output": "unsqueeze_4", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d", + "inputs": [ + "cat_1", + "unsqueeze_4" + ], + "output": "conv1d", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_11", + "inputs": [ + "conv1d" + ], + "output": "slice_11", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu", + "inputs": [ + "slice_11" + ], + "output": "silu", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_12", + "inputs": [ + "silu" + ], + "output": "slice_12", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_14", + "inputs": [ + "slice_12" + ], + "output": "transpose_14", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_13", + "inputs": [ + "transpose_14" + ], + "output": "slice_13", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_14", + "inputs": [ + "transpose_14" + ], + "output": "slice_14", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_15", + "inputs": [ + "transpose_14" + ], + "output": "slice_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_1", + "inputs": [ + "slice_13" + ], + "output": "view_1", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_2", + "inputs": [ + "slice_14" + ], + "output": "view_2", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_3", + "inputs": [ + "slice_15" + ], + "output": "view_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid", + "inputs": [ + "linear_2" + ], + "output": "sigmoid", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp", + "inputs": [ + "p_model_model_language_model_layers_0_linear_attn_a_log" + ], + "output": "exp", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg", + "inputs": [ + "exp" + ], + "output": "neg", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_2", + "inputs": [ + "linear_3", + "p_model_model_language_model_layers_0_linear_attn_dt_bias" + ], + "output": "add_2", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus", + "inputs": [ + "add_2" + ], + "output": "softplus", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_4", + "inputs": [ + "neg", + "softplus" + ], + "output": "mul_4", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_5", + "inputs": [ + "view_1" + ], + "output": "mul_5", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_1", + "inputs": [ + "mul_5" + ], + "output": "sum_1", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_3", + "inputs": [ + "sum_1" + ], + "output": "add_3", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_1", + "inputs": [ + "add_3" + ], + "output": "rsqrt_1", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_6", + "inputs": [ + "view_1", + "rsqrt_1" + ], + "output": "mul_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_7", + "inputs": [ + "view_2" + ], + "output": "mul_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_2", + "inputs": [ + "mul_7" + ], + "output": "sum_2", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_4", + "inputs": [ + "sum_2" + ], + "output": "add_4", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_2", + "inputs": [ + "add_4" + ], + "output": "rsqrt_2", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_8", + "inputs": [ + "view_2", + "rsqrt_2" + ], + "output": "mul_8", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule", + "inputs": [ + "mul_6", + "mul_8", + "view_3", + "mul_4", + "sigmoid", + "states_1" + ], + "output": "normalized_gated_delta_rule", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_16", + "inputs": [ + "normalized_gated_delta_rule" + ], + "output": "slice_16", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_1", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_17", + "inputs": [ + "normalized_gated_delta_rule" + ], + "output": "slice_17", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_15", + "inputs": [ + "slice_17" + ], + "output": "transpose_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone", + "inputs": [ + "transpose_15" + ], + "output": "clone", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_4", + "inputs": [ + "clone" + ], + "output": "view_4", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_5", + "inputs": [ + "view" + ], + "output": "view_5", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_10", + "inputs": [ + "view_4", + "p_model_model_language_model_layers_0_linear_attn_norm_weight" + ], + "output": "mul_10", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_11", + "inputs": [ + "view_5", + "mul_10" + ], + "output": "mul_11", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_6", + "inputs": [ + "mul_11" + ], + "output": "view_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_4", + "inputs": [ + "view_6", + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight" + ], + "output": "linear_4", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_6", + "inputs": [ + "where", + "linear_4" + ], + "output": "add_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_13", + "inputs": [ + "add_6", + "p_model_model_language_model_layers_0_post_attention_layernorm_weight" + ], + "output": "mul_13", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_1", + "inputs": [ + "mul_13" + ], + "output": "type_as_1", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_5", + "inputs": [ + "type_as_1", + "p_model_model_language_model_layers_0_mlp_gate_proj_weight" + ], + "output": "linear_5", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_6", + "inputs": [ + "type_as_1", + "p_model_model_language_model_layers_0_mlp_up_proj_weight" + ], + "output": "linear_6", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_14", + "inputs": [ + "linear_5", + "linear_6" + ], + "output": "mul_14", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_7", + "inputs": [ + "mul_14", + "p_model_model_language_model_layers_0_mlp_down_proj_weight" + ], + "output": "linear_7", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_9", + "inputs": [ + "add_6", + "linear_7" + ], + "output": "add_9", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_16", + "inputs": [ + "add_9", + "p_model_model_language_model_layers_1_input_layernorm_weight" + ], + "output": "mul_16", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_2", + "inputs": [ + "mul_16" + ], + "output": "type_as_2", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_8", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_8", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_16", + "inputs": [ + "linear_8" + ], + "output": "transpose_16", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_9", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight" + ], + "output": "linear_9", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_7", + "inputs": [ + "linear_9" + ], + "output": "view_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_10", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight" + ], + "output": "linear_10", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_11", + "inputs": [ + "type_as_2", + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight" + ], + "output": "linear_11", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_2", + "inputs": [ + "states_2", + "transpose_16" + ], + "output": "cat_2", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_18", + "inputs": [ + "cat_2" + ], + "output": "slice_18", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_2", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_1", + "inputs": [ + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight" + ], + "output": "squeeze_1", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_5", + "inputs": [ + "squeeze_1" + ], + "output": "unsqueeze_5", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_1", + "inputs": [ + "cat_2", + "unsqueeze_5" + ], + "output": "conv1d_1", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_19", + "inputs": [ + "conv1d_1" + ], + "output": "slice_19", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_3", + "inputs": [ + "slice_19" + ], + "output": "silu_3", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_20", + "inputs": [ + "silu_3" + ], + "output": "slice_20", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_17", + "inputs": [ + "slice_20" + ], + "output": "transpose_17", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_21", + "inputs": [ + "transpose_17" + ], + "output": "slice_21", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_22", + "inputs": [ + "transpose_17" + ], + "output": "slice_22", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_23", + "inputs": [ + "transpose_17" + ], + "output": "slice_23", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_8", + "inputs": [ + "slice_21" + ], + "output": "view_8", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_9", + "inputs": [ + "slice_22" + ], + "output": "view_9", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_10", + "inputs": [ + "slice_23" + ], + "output": "view_10", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_1", + "inputs": [ + "linear_10" + ], + "output": "sigmoid_1", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_1", + "inputs": [ + "p_model_model_language_model_layers_1_linear_attn_a_log" + ], + "output": "exp_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_1", + "inputs": [ + "exp_1" + ], + "output": "neg_1", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_12", + "inputs": [ + "linear_11", + "p_model_model_language_model_layers_1_linear_attn_dt_bias" + ], + "output": "add_12", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_1", + "inputs": [ + "add_12" + ], + "output": "softplus_1", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_17", + "inputs": [ + "neg_1", + "softplus_1" + ], + "output": "mul_17", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_18", + "inputs": [ + "view_8" + ], + "output": "mul_18", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_3", + "inputs": [ + "mul_18" + ], + "output": "sum_3", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_13", + "inputs": [ + "sum_3" + ], + "output": "add_13", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_6", + "inputs": [ + "add_13" + ], + "output": "rsqrt_6", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_19", + "inputs": [ + "view_8", + "rsqrt_6" + ], + "output": "mul_19", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_20", + "inputs": [ + "view_9" + ], + "output": "mul_20", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_4", + "inputs": [ + "mul_20" + ], + "output": "sum_4", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_14", + "inputs": [ + "sum_4" + ], + "output": "add_14", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_7", + "inputs": [ + "add_14" + ], + "output": "rsqrt_7", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_21", + "inputs": [ + "view_9", + "rsqrt_7" + ], + "output": "mul_21", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_1", + "inputs": [ + "mul_19", + "mul_21", + "view_10", + "mul_17", + "sigmoid_1", + "states_3" + ], + "output": "normalized_gated_delta_rule_1", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_24", + "inputs": [ + "normalized_gated_delta_rule_1" + ], + "output": "slice_24", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_3", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_25", + "inputs": [ + "normalized_gated_delta_rule_1" + ], + "output": "slice_25", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_18", + "inputs": [ + "slice_25" + ], + "output": "transpose_18", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_1", + "inputs": [ + "transpose_18" + ], + "output": "clone_1", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_11", + "inputs": [ + "clone_1" + ], + "output": "view_11", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_12", + "inputs": [ + "view_7" + ], + "output": "view_12", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_23", + "inputs": [ + "view_11", + "p_model_model_language_model_layers_1_linear_attn_norm_weight" + ], + "output": "mul_23", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_24", + "inputs": [ + "view_12", + "mul_23" + ], + "output": "mul_24", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_13", + "inputs": [ + "mul_24" + ], + "output": "view_13", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_12", + "inputs": [ + "view_13", + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight" + ], + "output": "linear_12", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_16", + "inputs": [ + "add_9", + "linear_12" + ], + "output": "add_16", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_26", + "inputs": [ + "add_16", + "p_model_model_language_model_layers_1_post_attention_layernorm_weight" + ], + "output": "mul_26", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_3", + "inputs": [ + "mul_26" + ], + "output": "type_as_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_13", + "inputs": [ + "type_as_3", + "p_model_model_language_model_layers_1_mlp_gate_proj_weight" + ], + "output": "linear_13", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_14", + "inputs": [ + "type_as_3", + "p_model_model_language_model_layers_1_mlp_up_proj_weight" + ], + "output": "linear_14", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_27", + "inputs": [ + "linear_13", + "linear_14" + ], + "output": "mul_27", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_15", + "inputs": [ + "mul_27", + "p_model_model_language_model_layers_1_mlp_down_proj_weight" + ], + "output": "linear_15", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_19", + "inputs": [ + "add_16", + "linear_15" + ], + "output": "add_19", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_29", + "inputs": [ + "add_19", + "p_model_model_language_model_layers_2_input_layernorm_weight" + ], + "output": "mul_29", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_4", + "inputs": [ + "mul_29" + ], + "output": "type_as_4", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_16", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_16", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_19", + "inputs": [ + "linear_16" + ], + "output": "transpose_19", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_17", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight" + ], + "output": "linear_17", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_14", + "inputs": [ + "linear_17" + ], + "output": "view_14", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_18", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight" + ], + "output": "linear_18", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_19", + "inputs": [ + "type_as_4", + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight" + ], + "output": "linear_19", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_3", + "inputs": [ + "states_4", + "transpose_19" + ], + "output": "cat_3", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_26", + "inputs": [ + "cat_3" + ], + "output": "slice_26", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_4", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_2", + "inputs": [ + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight" + ], + "output": "squeeze_2", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_6", + "inputs": [ + "squeeze_2" + ], + "output": "unsqueeze_6", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_2", + "inputs": [ + "cat_3", + "unsqueeze_6" + ], + "output": "conv1d_2", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_27", + "inputs": [ + "conv1d_2" + ], + "output": "slice_27", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_6", + "inputs": [ + "slice_27" + ], + "output": "silu_6", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_28", + "inputs": [ + "silu_6" + ], + "output": "slice_28", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_20", + "inputs": [ + "slice_28" + ], + "output": "transpose_20", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_29", + "inputs": [ + "transpose_20" + ], + "output": "slice_29", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_30", + "inputs": [ + "transpose_20" + ], + "output": "slice_30", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_31", + "inputs": [ + "transpose_20" + ], + "output": "slice_31", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_15", + "inputs": [ + "slice_29" + ], + "output": "view_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_16", + "inputs": [ + "slice_30" + ], + "output": "view_16", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_17", + "inputs": [ + "slice_31" + ], + "output": "view_17", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_2", + "inputs": [ + "linear_18" + ], + "output": "sigmoid_2", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_2", + "inputs": [ + "p_model_model_language_model_layers_2_linear_attn_a_log" + ], + "output": "exp_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_2", + "inputs": [ + "exp_2" + ], + "output": "neg_2", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_22", + "inputs": [ + "linear_19", + "p_model_model_language_model_layers_2_linear_attn_dt_bias" + ], + "output": "add_22", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_2", + "inputs": [ + "add_22" + ], + "output": "softplus_2", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_30", + "inputs": [ + "neg_2", + "softplus_2" + ], + "output": "mul_30", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_31", + "inputs": [ + "view_15" + ], + "output": "mul_31", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_5", + "inputs": [ + "mul_31" + ], + "output": "sum_5", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_23", + "inputs": [ + "sum_5" + ], + "output": "add_23", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_11", + "inputs": [ + "add_23" + ], + "output": "rsqrt_11", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_32", + "inputs": [ + "view_15", + "rsqrt_11" + ], + "output": "mul_32", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_33", + "inputs": [ + "view_16" + ], + "output": "mul_33", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_6", + "inputs": [ + "mul_33" + ], + "output": "sum_6", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_24", + "inputs": [ + "sum_6" + ], + "output": "add_24", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_12", + "inputs": [ + "add_24" + ], + "output": "rsqrt_12", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_34", + "inputs": [ + "view_16", + "rsqrt_12" + ], + "output": "mul_34", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_2", + "inputs": [ + "mul_32", + "mul_34", + "view_17", + "mul_30", + "sigmoid_2", + "states_5" + ], + "output": "normalized_gated_delta_rule_2", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_32", + "inputs": [ + "normalized_gated_delta_rule_2" + ], + "output": "slice_32", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_5", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_33", + "inputs": [ + "normalized_gated_delta_rule_2" + ], + "output": "slice_33", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_21", + "inputs": [ + "slice_33" + ], + "output": "transpose_21", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_2", + "inputs": [ + "transpose_21" + ], + "output": "clone_2", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_18", + "inputs": [ + "clone_2" + ], + "output": "view_18", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_19", + "inputs": [ + "view_14" + ], + "output": "view_19", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_36", + "inputs": [ + "view_18", + "p_model_model_language_model_layers_2_linear_attn_norm_weight" + ], + "output": "mul_36", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_37", + "inputs": [ + "view_19", + "mul_36" + ], + "output": "mul_37", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_20", + "inputs": [ + "mul_37" + ], + "output": "view_20", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_20", + "inputs": [ + "view_20", + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight" + ], + "output": "linear_20", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_26", + "inputs": [ + "add_19", + "linear_20" + ], + "output": "add_26", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_39", + "inputs": [ + "add_26", + "p_model_model_language_model_layers_2_post_attention_layernorm_weight" + ], + "output": "mul_39", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_5", + "inputs": [ + "mul_39" + ], + "output": "type_as_5", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_21", + "inputs": [ + "type_as_5", + "p_model_model_language_model_layers_2_mlp_gate_proj_weight" + ], + "output": "linear_21", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_22", + "inputs": [ + "type_as_5", + "p_model_model_language_model_layers_2_mlp_up_proj_weight" + ], + "output": "linear_22", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_40", + "inputs": [ + "linear_21", + "linear_22" + ], + "output": "mul_40", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_23", + "inputs": [ + "mul_40", + "p_model_model_language_model_layers_2_mlp_down_proj_weight" + ], + "output": "linear_23", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_29", + "inputs": [ + "add_26", + "linear_23" + ], + "output": "add_29", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_42", + "inputs": [ + "add_29", + "p_model_model_language_model_layers_3_input_layernorm_weight" + ], + "output": "mul_42", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_6", + "inputs": [ + "mul_42" + ], + "output": "type_as_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_24", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_q_proj_weight" + ], + "output": "linear_24", + "workgroups": [ + 512, + 8, + 1 + ], + "kernel": "kernels/ec17c9e66b2ad1dbed2547b1df93357497b8fca1052cd2375de06b2925123a97.wgsl" + }, + { + "node": "view_21", + "inputs": [ + "linear_24" + ], + "output": "view_21", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl" + }, + { + "node": "slice_34", + "inputs": [ + "view_21" + ], + "output": "slice_34", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl" + }, + { + "node": "slice_35", + "inputs": [ + "view_21" + ], + "output": "slice_35", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl" + }, + { + "node": "clone_3", + "inputs": [ + "slice_35" + ], + "output": "clone_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "_unsafe_view", + "inputs": [ + "clone_3" + ], + "output": "_unsafe_view", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_22", + "inputs": [ + "slice_34" + ], + "output": "view_22", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_44", + "inputs": [ + "view_22", + "p_model_model_language_model_layers_3_self_attn_q_norm_weight" + ], + "output": "mul_44", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl" + }, + { + "node": "type_as_7", + "inputs": [ + "mul_44" + ], + "output": "type_as_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "transpose_22", + "inputs": [ + "type_as_7" + ], + "output": "transpose_22", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl" + }, + { + "node": "linear_25", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_k_proj_weight" + ], + "output": "linear_25", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_23", + "inputs": [ + "linear_25" + ], + "output": "view_23", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_46", + "inputs": [ + "view_23", + "p_model_model_language_model_layers_3_self_attn_k_norm_weight" + ], + "output": "mul_46", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_8", + "inputs": [ + "mul_46" + ], + "output": "type_as_8", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_23", + "inputs": [ + "type_as_8" + ], + "output": "transpose_23", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "linear_26", + "inputs": [ + "type_as_6", + "p_model_model_language_model_layers_3_self_attn_v_proj_weight" + ], + "output": "linear_26", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_24", + "inputs": [ + "linear_26" + ], + "output": "view_24", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_24", + "inputs": [ + "view_24" + ], + "output": "transpose_24", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "unsqueeze_7", + "inputs": [ + "mul" + ], + "output": "unsqueeze_7", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "unsqueeze_8", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_8", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "slice_36", + "inputs": [ + "transpose_22" + ], + "output": "slice_36", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl" + }, + { + "node": "slice_37", + "inputs": [ + "transpose_22" + ], + "output": "slice_37", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl" + }, + { + "node": "slice_38", + "inputs": [ + "transpose_23" + ], + "output": "slice_38", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl" + }, + { + "node": "slice_39", + "inputs": [ + "transpose_23" + ], + "output": "slice_39", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl" + }, + { + "node": "mul_47", + "inputs": [ + "slice_36", + "unsqueeze_7" + ], + "output": "mul_47", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "slice_40", + "inputs": [ + "slice_36" + ], + "output": "slice_40", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl" + }, + { + "node": "slice_41", + "inputs": [ + "slice_36" + ], + "output": "slice_41", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl" + }, + { + "node": "neg_3", + "inputs": [ + "slice_41" + ], + "output": "neg_3", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl" + }, + { + "node": "cat_4", + "inputs": [ + "neg_3", + "slice_40" + ], + "output": "cat_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl" + }, + { + "node": "mul_48", + "inputs": [ + "cat_4", + "unsqueeze_8" + ], + "output": "mul_48", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "add_36", + "inputs": [ + "mul_47", + "mul_48" + ], + "output": "add_36", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_49", + "inputs": [ + "slice_38", + "unsqueeze_7" + ], + "output": "mul_49", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "slice_42", + "inputs": [ + "slice_38" + ], + "output": "slice_42", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl" + }, + { + "node": "slice_43", + "inputs": [ + "slice_38" + ], + "output": "slice_43", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl" + }, + { + "node": "neg_4", + "inputs": [ + "slice_43" + ], + "output": "neg_4", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_5", + "inputs": [ + "neg_4", + "slice_42" + ], + "output": "cat_5", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_50", + "inputs": [ + "cat_5", + "unsqueeze_8" + ], + "output": "mul_50", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "add_37", + "inputs": [ + "mul_49", + "mul_50" + ], + "output": "add_37", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "cat_6", + "inputs": [ + "add_36", + "slice_37" + ], + "output": "cat_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl" + }, + { + "node": "cat_7", + "inputs": [ + "add_37", + "slice_39" + ], + "output": "cat_7", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cache_update", + "inputs": [ + "cat_7", + "cache_position" + ], + "output": "cache_update", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_6", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "cache_update_1", + "inputs": [ + "transpose_24", + "cache_position" + ], + "output": "cache_update_1", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_7", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "unsqueeze_9", + "inputs": [ + "cache_update" + ], + "output": "unsqueeze_9", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_1", + "inputs": [ + "unsqueeze_9" + ], + "output": "expand_1", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_4", + "inputs": [ + "expand_1" + ], + "output": "clone_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_1", + "inputs": [ + "clone_4" + ], + "output": "_unsafe_view_1", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_10", + "inputs": [ + "cache_update_1" + ], + "output": "unsqueeze_10", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_2", + "inputs": [ + "unsqueeze_10" + ], + "output": "expand_2", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_5", + "inputs": [ + "expand_2" + ], + "output": "clone_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_2", + "inputs": [ + "clone_5" + ], + "output": "_unsafe_view_2", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_25", + "inputs": [ + "_unsafe_view_1" + ], + "output": "transpose_25", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_1", + "inputs": [ + "cat_6", + "transpose_25" + ], + "output": "matmul_1", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl" + }, + { + "node": "mul_51", + "inputs": [ + "matmul_1" + ], + "output": "mul_51", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl" + }, + { + "node": "add_38", + "inputs": [ + "mul_51", + "attention_mask" + ], + "output": "add_38", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl" + }, + { + "node": "softmax", + "inputs": [ + "add_38" + ], + "output": "softmax", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl" + }, + { + "node": "matmul_2", + "inputs": [ + "softmax", + "_unsafe_view_2" + ], + "output": "matmul_2", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl" + }, + { + "node": "transpose_26", + "inputs": [ + "matmul_2" + ], + "output": "transpose_26", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl" + }, + { + "node": "clone_6", + "inputs": [ + "transpose_26" + ], + "output": "clone_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_25", + "inputs": [ + "clone_6" + ], + "output": "view_25", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_3", + "inputs": [ + "_unsafe_view" + ], + "output": "sigmoid_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl" + }, + { + "node": "mul_52", + "inputs": [ + "view_25", + "sigmoid_3" + ], + "output": "mul_52", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl" + }, + { + "node": "linear_27", + "inputs": [ + "mul_52", + "p_model_model_language_model_layers_3_self_attn_o_proj_weight" + ], + "output": "linear_27", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_39", + "inputs": [ + "add_29", + "linear_27" + ], + "output": "add_39", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_54", + "inputs": [ + "add_39", + "p_model_model_language_model_layers_3_post_attention_layernorm_weight" + ], + "output": "mul_54", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_9", + "inputs": [ + "mul_54" + ], + "output": "type_as_9", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_28", + "inputs": [ + "type_as_9", + "p_model_model_language_model_layers_3_mlp_gate_proj_weight" + ], + "output": "linear_28", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_29", + "inputs": [ + "type_as_9", + "p_model_model_language_model_layers_3_mlp_up_proj_weight" + ], + "output": "linear_29", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_55", + "inputs": [ + "linear_28", + "linear_29" + ], + "output": "mul_55", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_30", + "inputs": [ + "mul_55", + "p_model_model_language_model_layers_3_mlp_down_proj_weight" + ], + "output": "linear_30", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_42", + "inputs": [ + "add_39", + "linear_30" + ], + "output": "add_42", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_57", + "inputs": [ + "add_42", + "p_model_model_language_model_layers_4_input_layernorm_weight" + ], + "output": "mul_57", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_10", + "inputs": [ + "mul_57" + ], + "output": "type_as_10", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_31", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_31", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_27", + "inputs": [ + "linear_31" + ], + "output": "transpose_27", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_32", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight" + ], + "output": "linear_32", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_26", + "inputs": [ + "linear_32" + ], + "output": "view_26", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_33", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight" + ], + "output": "linear_33", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_34", + "inputs": [ + "type_as_10", + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight" + ], + "output": "linear_34", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_8", + "inputs": [ + "states_8", + "transpose_27" + ], + "output": "cat_8", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_44", + "inputs": [ + "cat_8" + ], + "output": "slice_44", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_8", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_3", + "inputs": [ + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight" + ], + "output": "squeeze_3", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_11", + "inputs": [ + "squeeze_3" + ], + "output": "unsqueeze_11", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_3", + "inputs": [ + "cat_8", + "unsqueeze_11" + ], + "output": "conv1d_3", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_45", + "inputs": [ + "conv1d_3" + ], + "output": "slice_45", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_10", + "inputs": [ + "slice_45" + ], + "output": "silu_10", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_46", + "inputs": [ + "silu_10" + ], + "output": "slice_46", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_28", + "inputs": [ + "slice_46" + ], + "output": "transpose_28", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_47", + "inputs": [ + "transpose_28" + ], + "output": "slice_47", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_48", + "inputs": [ + "transpose_28" + ], + "output": "slice_48", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_49", + "inputs": [ + "transpose_28" + ], + "output": "slice_49", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_27", + "inputs": [ + "slice_47" + ], + "output": "view_27", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_28", + "inputs": [ + "slice_48" + ], + "output": "view_28", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_29", + "inputs": [ + "slice_49" + ], + "output": "view_29", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_4", + "inputs": [ + "linear_33" + ], + "output": "sigmoid_4", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_3", + "inputs": [ + "p_model_model_language_model_layers_4_linear_attn_a_log" + ], + "output": "exp_3", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_5", + "inputs": [ + "exp_3" + ], + "output": "neg_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_45", + "inputs": [ + "linear_34", + "p_model_model_language_model_layers_4_linear_attn_dt_bias" + ], + "output": "add_45", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_3", + "inputs": [ + "add_45" + ], + "output": "softplus_3", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_58", + "inputs": [ + "neg_5", + "softplus_3" + ], + "output": "mul_58", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_59", + "inputs": [ + "view_27" + ], + "output": "mul_59", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_7", + "inputs": [ + "mul_59" + ], + "output": "sum_7", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_46", + "inputs": [ + "sum_7" + ], + "output": "add_46", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_20", + "inputs": [ + "add_46" + ], + "output": "rsqrt_20", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_60", + "inputs": [ + "view_27", + "rsqrt_20" + ], + "output": "mul_60", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_61", + "inputs": [ + "view_28" + ], + "output": "mul_61", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_8", + "inputs": [ + "mul_61" + ], + "output": "sum_8", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_47", + "inputs": [ + "sum_8" + ], + "output": "add_47", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_21", + "inputs": [ + "add_47" + ], + "output": "rsqrt_21", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_62", + "inputs": [ + "view_28", + "rsqrt_21" + ], + "output": "mul_62", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_3", + "inputs": [ + "mul_60", + "mul_62", + "view_29", + "mul_58", + "sigmoid_4", + "states_9" + ], + "output": "normalized_gated_delta_rule_3", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_50", + "inputs": [ + "normalized_gated_delta_rule_3" + ], + "output": "slice_50", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_9", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_51", + "inputs": [ + "normalized_gated_delta_rule_3" + ], + "output": "slice_51", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_29", + "inputs": [ + "slice_51" + ], + "output": "transpose_29", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_7", + "inputs": [ + "transpose_29" + ], + "output": "clone_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_30", + "inputs": [ + "clone_7" + ], + "output": "view_30", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_31", + "inputs": [ + "view_26" + ], + "output": "view_31", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_64", + "inputs": [ + "view_30", + "p_model_model_language_model_layers_4_linear_attn_norm_weight" + ], + "output": "mul_64", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_65", + "inputs": [ + "view_31", + "mul_64" + ], + "output": "mul_65", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_32", + "inputs": [ + "mul_65" + ], + "output": "view_32", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_35", + "inputs": [ + "view_32", + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight" + ], + "output": "linear_35", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_49", + "inputs": [ + "add_42", + "linear_35" + ], + "output": "add_49", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_67", + "inputs": [ + "add_49", + "p_model_model_language_model_layers_4_post_attention_layernorm_weight" + ], + "output": "mul_67", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_11", + "inputs": [ + "mul_67" + ], + "output": "type_as_11", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_36", + "inputs": [ + "type_as_11", + "p_model_model_language_model_layers_4_mlp_gate_proj_weight" + ], + "output": "linear_36", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_37", + "inputs": [ + "type_as_11", + "p_model_model_language_model_layers_4_mlp_up_proj_weight" + ], + "output": "linear_37", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_68", + "inputs": [ + "linear_36", + "linear_37" + ], + "output": "mul_68", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_38", + "inputs": [ + "mul_68", + "p_model_model_language_model_layers_4_mlp_down_proj_weight" + ], + "output": "linear_38", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_52", + "inputs": [ + "add_49", + "linear_38" + ], + "output": "add_52", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_70", + "inputs": [ + "add_52", + "p_model_model_language_model_layers_5_input_layernorm_weight" + ], + "output": "mul_70", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_12", + "inputs": [ + "mul_70" + ], + "output": "type_as_12", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_39", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_39", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_30", + "inputs": [ + "linear_39" + ], + "output": "transpose_30", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_40", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight" + ], + "output": "linear_40", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_33", + "inputs": [ + "linear_40" + ], + "output": "view_33", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_41", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight" + ], + "output": "linear_41", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_42", + "inputs": [ + "type_as_12", + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight" + ], + "output": "linear_42", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_9", + "inputs": [ + "states_10", + "transpose_30" + ], + "output": "cat_9", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_52", + "inputs": [ + "cat_9" + ], + "output": "slice_52", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_10", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_4", + "inputs": [ + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight" + ], + "output": "squeeze_4", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_12", + "inputs": [ + "squeeze_4" + ], + "output": "unsqueeze_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_4", + "inputs": [ + "cat_9", + "unsqueeze_12" + ], + "output": "conv1d_4", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_53", + "inputs": [ + "conv1d_4" + ], + "output": "slice_53", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_13", + "inputs": [ + "slice_53" + ], + "output": "silu_13", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_54", + "inputs": [ + "silu_13" + ], + "output": "slice_54", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_31", + "inputs": [ + "slice_54" + ], + "output": "transpose_31", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_55", + "inputs": [ + "transpose_31" + ], + "output": "slice_55", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_56", + "inputs": [ + "transpose_31" + ], + "output": "slice_56", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_57", + "inputs": [ + "transpose_31" + ], + "output": "slice_57", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_34", + "inputs": [ + "slice_55" + ], + "output": "view_34", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_35", + "inputs": [ + "slice_56" + ], + "output": "view_35", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_36", + "inputs": [ + "slice_57" + ], + "output": "view_36", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_5", + "inputs": [ + "linear_41" + ], + "output": "sigmoid_5", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_4", + "inputs": [ + "p_model_model_language_model_layers_5_linear_attn_a_log" + ], + "output": "exp_4", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_6", + "inputs": [ + "exp_4" + ], + "output": "neg_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_55", + "inputs": [ + "linear_42", + "p_model_model_language_model_layers_5_linear_attn_dt_bias" + ], + "output": "add_55", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_4", + "inputs": [ + "add_55" + ], + "output": "softplus_4", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_71", + "inputs": [ + "neg_6", + "softplus_4" + ], + "output": "mul_71", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_72", + "inputs": [ + "view_34" + ], + "output": "mul_72", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_9", + "inputs": [ + "mul_72" + ], + "output": "sum_9", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_56", + "inputs": [ + "sum_9" + ], + "output": "add_56", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_25", + "inputs": [ + "add_56" + ], + "output": "rsqrt_25", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_73", + "inputs": [ + "view_34", + "rsqrt_25" + ], + "output": "mul_73", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_74", + "inputs": [ + "view_35" + ], + "output": "mul_74", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_10", + "inputs": [ + "mul_74" + ], + "output": "sum_10", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_57", + "inputs": [ + "sum_10" + ], + "output": "add_57", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_26", + "inputs": [ + "add_57" + ], + "output": "rsqrt_26", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_75", + "inputs": [ + "view_35", + "rsqrt_26" + ], + "output": "mul_75", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_4", + "inputs": [ + "mul_73", + "mul_75", + "view_36", + "mul_71", + "sigmoid_5", + "states_11" + ], + "output": "normalized_gated_delta_rule_4", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_58", + "inputs": [ + "normalized_gated_delta_rule_4" + ], + "output": "slice_58", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_11", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_59", + "inputs": [ + "normalized_gated_delta_rule_4" + ], + "output": "slice_59", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_32", + "inputs": [ + "slice_59" + ], + "output": "transpose_32", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_8", + "inputs": [ + "transpose_32" + ], + "output": "clone_8", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_37", + "inputs": [ + "clone_8" + ], + "output": "view_37", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_38", + "inputs": [ + "view_33" + ], + "output": "view_38", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_77", + "inputs": [ + "view_37", + "p_model_model_language_model_layers_5_linear_attn_norm_weight" + ], + "output": "mul_77", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_78", + "inputs": [ + "view_38", + "mul_77" + ], + "output": "mul_78", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_39", + "inputs": [ + "mul_78" + ], + "output": "view_39", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_43", + "inputs": [ + "view_39", + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight" + ], + "output": "linear_43", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_59", + "inputs": [ + "add_52", + "linear_43" + ], + "output": "add_59", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_80", + "inputs": [ + "add_59", + "p_model_model_language_model_layers_5_post_attention_layernorm_weight" + ], + "output": "mul_80", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_13", + "inputs": [ + "mul_80" + ], + "output": "type_as_13", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_44", + "inputs": [ + "type_as_13", + "p_model_model_language_model_layers_5_mlp_gate_proj_weight" + ], + "output": "linear_44", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_45", + "inputs": [ + "type_as_13", + "p_model_model_language_model_layers_5_mlp_up_proj_weight" + ], + "output": "linear_45", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_81", + "inputs": [ + "linear_44", + "linear_45" + ], + "output": "mul_81", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_46", + "inputs": [ + "mul_81", + "p_model_model_language_model_layers_5_mlp_down_proj_weight" + ], + "output": "linear_46", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_62", + "inputs": [ + "add_59", + "linear_46" + ], + "output": "add_62", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_83", + "inputs": [ + "add_62", + "p_model_model_language_model_layers_6_input_layernorm_weight" + ], + "output": "mul_83", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_14", + "inputs": [ + "mul_83" + ], + "output": "type_as_14", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_47", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_47", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_33", + "inputs": [ + "linear_47" + ], + "output": "transpose_33", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_48", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight" + ], + "output": "linear_48", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_40", + "inputs": [ + "linear_48" + ], + "output": "view_40", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_49", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight" + ], + "output": "linear_49", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_50", + "inputs": [ + "type_as_14", + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight" + ], + "output": "linear_50", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_10", + "inputs": [ + "states_12", + "transpose_33" + ], + "output": "cat_10", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_60", + "inputs": [ + "cat_10" + ], + "output": "slice_60", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_12", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_5", + "inputs": [ + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight" + ], + "output": "squeeze_5", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_13", + "inputs": [ + "squeeze_5" + ], + "output": "unsqueeze_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_5", + "inputs": [ + "cat_10", + "unsqueeze_13" + ], + "output": "conv1d_5", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_61", + "inputs": [ + "conv1d_5" + ], + "output": "slice_61", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_16", + "inputs": [ + "slice_61" + ], + "output": "silu_16", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_62", + "inputs": [ + "silu_16" + ], + "output": "slice_62", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_34", + "inputs": [ + "slice_62" + ], + "output": "transpose_34", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_63", + "inputs": [ + "transpose_34" + ], + "output": "slice_63", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_64", + "inputs": [ + "transpose_34" + ], + "output": "slice_64", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_65", + "inputs": [ + "transpose_34" + ], + "output": "slice_65", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_41", + "inputs": [ + "slice_63" + ], + "output": "view_41", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_42", + "inputs": [ + "slice_64" + ], + "output": "view_42", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_43", + "inputs": [ + "slice_65" + ], + "output": "view_43", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_6", + "inputs": [ + "linear_49" + ], + "output": "sigmoid_6", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_5", + "inputs": [ + "p_model_model_language_model_layers_6_linear_attn_a_log" + ], + "output": "exp_5", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_7", + "inputs": [ + "exp_5" + ], + "output": "neg_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_65", + "inputs": [ + "linear_50", + "p_model_model_language_model_layers_6_linear_attn_dt_bias" + ], + "output": "add_65", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_5", + "inputs": [ + "add_65" + ], + "output": "softplus_5", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_84", + "inputs": [ + "neg_7", + "softplus_5" + ], + "output": "mul_84", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_85", + "inputs": [ + "view_41" + ], + "output": "mul_85", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_11", + "inputs": [ + "mul_85" + ], + "output": "sum_11", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_66", + "inputs": [ + "sum_11" + ], + "output": "add_66", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_30", + "inputs": [ + "add_66" + ], + "output": "rsqrt_30", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_86", + "inputs": [ + "view_41", + "rsqrt_30" + ], + "output": "mul_86", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_87", + "inputs": [ + "view_42" + ], + "output": "mul_87", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_12", + "inputs": [ + "mul_87" + ], + "output": "sum_12", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_67", + "inputs": [ + "sum_12" + ], + "output": "add_67", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_31", + "inputs": [ + "add_67" + ], + "output": "rsqrt_31", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_88", + "inputs": [ + "view_42", + "rsqrt_31" + ], + "output": "mul_88", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_5", + "inputs": [ + "mul_86", + "mul_88", + "view_43", + "mul_84", + "sigmoid_6", + "states_13" + ], + "output": "normalized_gated_delta_rule_5", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_66", + "inputs": [ + "normalized_gated_delta_rule_5" + ], + "output": "slice_66", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_13", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_67", + "inputs": [ + "normalized_gated_delta_rule_5" + ], + "output": "slice_67", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_35", + "inputs": [ + "slice_67" + ], + "output": "transpose_35", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_9", + "inputs": [ + "transpose_35" + ], + "output": "clone_9", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_44", + "inputs": [ + "clone_9" + ], + "output": "view_44", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_45", + "inputs": [ + "view_40" + ], + "output": "view_45", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_90", + "inputs": [ + "view_44", + "p_model_model_language_model_layers_6_linear_attn_norm_weight" + ], + "output": "mul_90", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_91", + "inputs": [ + "view_45", + "mul_90" + ], + "output": "mul_91", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_46", + "inputs": [ + "mul_91" + ], + "output": "view_46", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_51", + "inputs": [ + "view_46", + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight" + ], + "output": "linear_51", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_69", + "inputs": [ + "add_62", + "linear_51" + ], + "output": "add_69", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_93", + "inputs": [ + "add_69", + "p_model_model_language_model_layers_6_post_attention_layernorm_weight" + ], + "output": "mul_93", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_15", + "inputs": [ + "mul_93" + ], + "output": "type_as_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_52", + "inputs": [ + "type_as_15", + "p_model_model_language_model_layers_6_mlp_gate_proj_weight" + ], + "output": "linear_52", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_53", + "inputs": [ + "type_as_15", + "p_model_model_language_model_layers_6_mlp_up_proj_weight" + ], + "output": "linear_53", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_94", + "inputs": [ + "linear_52", + "linear_53" + ], + "output": "mul_94", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_54", + "inputs": [ + "mul_94", + "p_model_model_language_model_layers_6_mlp_down_proj_weight" + ], + "output": "linear_54", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_72", + "inputs": [ + "add_69", + "linear_54" + ], + "output": "add_72", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_96", + "inputs": [ + "add_72", + "p_model_model_language_model_layers_7_input_layernorm_weight" + ], + "output": "mul_96", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_16", + "inputs": [ + "mul_96" + ], + "output": "type_as_16", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_55", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_q_proj_weight" + ], + "output": "linear_55", + "workgroups": [ + 512, + 8, + 1 + ], + "kernel": "kernels/ec17c9e66b2ad1dbed2547b1df93357497b8fca1052cd2375de06b2925123a97.wgsl" + }, + { + "node": "view_47", + "inputs": [ + "linear_55" + ], + "output": "view_47", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl" + }, + { + "node": "slice_68", + "inputs": [ + "view_47" + ], + "output": "slice_68", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl" + }, + { + "node": "slice_69", + "inputs": [ + "view_47" + ], + "output": "slice_69", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl" + }, + { + "node": "clone_10", + "inputs": [ + "slice_69" + ], + "output": "clone_10", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "_unsafe_view_3", + "inputs": [ + "clone_10" + ], + "output": "_unsafe_view_3", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_48", + "inputs": [ + "slice_68" + ], + "output": "view_48", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_98", + "inputs": [ + "view_48", + "p_model_model_language_model_layers_7_self_attn_q_norm_weight" + ], + "output": "mul_98", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl" + }, + { + "node": "type_as_17", + "inputs": [ + "mul_98" + ], + "output": "type_as_17", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "transpose_36", + "inputs": [ + "type_as_17" + ], + "output": "transpose_36", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl" + }, + { + "node": "linear_56", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_k_proj_weight" + ], + "output": "linear_56", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_49", + "inputs": [ + "linear_56" + ], + "output": "view_49", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_100", + "inputs": [ + "view_49", + "p_model_model_language_model_layers_7_self_attn_k_norm_weight" + ], + "output": "mul_100", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_18", + "inputs": [ + "mul_100" + ], + "output": "type_as_18", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_37", + "inputs": [ + "type_as_18" + ], + "output": "transpose_37", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "linear_57", + "inputs": [ + "type_as_16", + "p_model_model_language_model_layers_7_self_attn_v_proj_weight" + ], + "output": "linear_57", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_50", + "inputs": [ + "linear_57" + ], + "output": "view_50", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_38", + "inputs": [ + "view_50" + ], + "output": "transpose_38", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "unsqueeze_14", + "inputs": [ + "mul" + ], + "output": "unsqueeze_14", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "unsqueeze_15", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_15", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "slice_70", + "inputs": [ + "transpose_36" + ], + "output": "slice_70", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl" + }, + { + "node": "slice_71", + "inputs": [ + "transpose_36" + ], + "output": "slice_71", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl" + }, + { + "node": "slice_72", + "inputs": [ + "transpose_37" + ], + "output": "slice_72", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl" + }, + { + "node": "slice_73", + "inputs": [ + "transpose_37" + ], + "output": "slice_73", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl" + }, + { + "node": "mul_101", + "inputs": [ + "slice_70", + "unsqueeze_14" + ], + "output": "mul_101", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "slice_74", + "inputs": [ + "slice_70" + ], + "output": "slice_74", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl" + }, + { + "node": "slice_75", + "inputs": [ + "slice_70" + ], + "output": "slice_75", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl" + }, + { + "node": "neg_8", + "inputs": [ + "slice_75" + ], + "output": "neg_8", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl" + }, + { + "node": "cat_11", + "inputs": [ + "neg_8", + "slice_74" + ], + "output": "cat_11", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl" + }, + { + "node": "mul_102", + "inputs": [ + "cat_11", + "unsqueeze_15" + ], + "output": "mul_102", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "add_79", + "inputs": [ + "mul_101", + "mul_102" + ], + "output": "add_79", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_103", + "inputs": [ + "slice_72", + "unsqueeze_14" + ], + "output": "mul_103", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "slice_76", + "inputs": [ + "slice_72" + ], + "output": "slice_76", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl" + }, + { + "node": "slice_77", + "inputs": [ + "slice_72" + ], + "output": "slice_77", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl" + }, + { + "node": "neg_9", + "inputs": [ + "slice_77" + ], + "output": "neg_9", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_12", + "inputs": [ + "neg_9", + "slice_76" + ], + "output": "cat_12", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_104", + "inputs": [ + "cat_12", + "unsqueeze_15" + ], + "output": "mul_104", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "add_80", + "inputs": [ + "mul_103", + "mul_104" + ], + "output": "add_80", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "cat_13", + "inputs": [ + "add_79", + "slice_71" + ], + "output": "cat_13", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl" + }, + { + "node": "cat_14", + "inputs": [ + "add_80", + "slice_73" + ], + "output": "cat_14", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cache_update_2", + "inputs": [ + "cat_14", + "cache_position" + ], + "output": "cache_update_2", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_14", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "cache_update_3", + "inputs": [ + "transpose_38", + "cache_position" + ], + "output": "cache_update_3", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_15", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "unsqueeze_16", + "inputs": [ + "cache_update_2" + ], + "output": "unsqueeze_16", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_3", + "inputs": [ + "unsqueeze_16" + ], + "output": "expand_3", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_11", + "inputs": [ + "expand_3" + ], + "output": "clone_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_4", + "inputs": [ + "clone_11" + ], + "output": "_unsafe_view_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_17", + "inputs": [ + "cache_update_3" + ], + "output": "unsqueeze_17", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_4", + "inputs": [ + "unsqueeze_17" + ], + "output": "expand_4", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_12", + "inputs": [ + "expand_4" + ], + "output": "clone_12", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_5", + "inputs": [ + "clone_12" + ], + "output": "_unsafe_view_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_39", + "inputs": [ + "_unsafe_view_4" + ], + "output": "transpose_39", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_3", + "inputs": [ + "cat_13", + "transpose_39" + ], + "output": "matmul_3", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl" + }, + { + "node": "mul_105", + "inputs": [ + "matmul_3" + ], + "output": "mul_105", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl" + }, + { + "node": "add_81", + "inputs": [ + "mul_105", + "attention_mask" + ], + "output": "add_81", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl" + }, + { + "node": "softmax_1", + "inputs": [ + "add_81" + ], + "output": "softmax_1", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl" + }, + { + "node": "matmul_4", + "inputs": [ + "softmax_1", + "_unsafe_view_5" + ], + "output": "matmul_4", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl" + }, + { + "node": "transpose_40", + "inputs": [ + "matmul_4" + ], + "output": "transpose_40", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl" + }, + { + "node": "clone_13", + "inputs": [ + "transpose_40" + ], + "output": "clone_13", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_51", + "inputs": [ + "clone_13" + ], + "output": "view_51", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_7", + "inputs": [ + "_unsafe_view_3" + ], + "output": "sigmoid_7", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl" + }, + { + "node": "mul_106", + "inputs": [ + "view_51", + "sigmoid_7" + ], + "output": "mul_106", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl" + }, + { + "node": "linear_58", + "inputs": [ + "mul_106", + "p_model_model_language_model_layers_7_self_attn_o_proj_weight" + ], + "output": "linear_58", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_82", + "inputs": [ + "add_72", + "linear_58" + ], + "output": "add_82", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_108", + "inputs": [ + "add_82", + "p_model_model_language_model_layers_7_post_attention_layernorm_weight" + ], + "output": "mul_108", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_19", + "inputs": [ + "mul_108" + ], + "output": "type_as_19", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_59", + "inputs": [ + "type_as_19", + "p_model_model_language_model_layers_7_mlp_gate_proj_weight" + ], + "output": "linear_59", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_60", + "inputs": [ + "type_as_19", + "p_model_model_language_model_layers_7_mlp_up_proj_weight" + ], + "output": "linear_60", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_109", + "inputs": [ + "linear_59", + "linear_60" + ], + "output": "mul_109", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_61", + "inputs": [ + "mul_109", + "p_model_model_language_model_layers_7_mlp_down_proj_weight" + ], + "output": "linear_61", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_85", + "inputs": [ + "add_82", + "linear_61" + ], + "output": "add_85", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_111", + "inputs": [ + "add_85", + "p_model_model_language_model_layers_8_input_layernorm_weight" + ], + "output": "mul_111", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_20", + "inputs": [ + "mul_111" + ], + "output": "type_as_20", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_62", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_62", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_41", + "inputs": [ + "linear_62" + ], + "output": "transpose_41", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_63", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight" + ], + "output": "linear_63", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_52", + "inputs": [ + "linear_63" + ], + "output": "view_52", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_64", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight" + ], + "output": "linear_64", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_65", + "inputs": [ + "type_as_20", + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight" + ], + "output": "linear_65", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_15", + "inputs": [ + "states_16", + "transpose_41" + ], + "output": "cat_15", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_78", + "inputs": [ + "cat_15" + ], + "output": "slice_78", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_16", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_6", + "inputs": [ + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight" + ], + "output": "squeeze_6", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_18", + "inputs": [ + "squeeze_6" + ], + "output": "unsqueeze_18", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_6", + "inputs": [ + "cat_15", + "unsqueeze_18" + ], + "output": "conv1d_6", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_79", + "inputs": [ + "conv1d_6" + ], + "output": "slice_79", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_20", + "inputs": [ + "slice_79" + ], + "output": "silu_20", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_80", + "inputs": [ + "silu_20" + ], + "output": "slice_80", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_42", + "inputs": [ + "slice_80" + ], + "output": "transpose_42", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_81", + "inputs": [ + "transpose_42" + ], + "output": "slice_81", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_82", + "inputs": [ + "transpose_42" + ], + "output": "slice_82", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_83", + "inputs": [ + "transpose_42" + ], + "output": "slice_83", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_53", + "inputs": [ + "slice_81" + ], + "output": "view_53", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_54", + "inputs": [ + "slice_82" + ], + "output": "view_54", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_55", + "inputs": [ + "slice_83" + ], + "output": "view_55", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_8", + "inputs": [ + "linear_64" + ], + "output": "sigmoid_8", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_6", + "inputs": [ + "p_model_model_language_model_layers_8_linear_attn_a_log" + ], + "output": "exp_6", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_10", + "inputs": [ + "exp_6" + ], + "output": "neg_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_88", + "inputs": [ + "linear_65", + "p_model_model_language_model_layers_8_linear_attn_dt_bias" + ], + "output": "add_88", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_6", + "inputs": [ + "add_88" + ], + "output": "softplus_6", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_112", + "inputs": [ + "neg_10", + "softplus_6" + ], + "output": "mul_112", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_113", + "inputs": [ + "view_53" + ], + "output": "mul_113", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_13", + "inputs": [ + "mul_113" + ], + "output": "sum_13", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_89", + "inputs": [ + "sum_13" + ], + "output": "add_89", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_39", + "inputs": [ + "add_89" + ], + "output": "rsqrt_39", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_114", + "inputs": [ + "view_53", + "rsqrt_39" + ], + "output": "mul_114", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_115", + "inputs": [ + "view_54" + ], + "output": "mul_115", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_14", + "inputs": [ + "mul_115" + ], + "output": "sum_14", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_90", + "inputs": [ + "sum_14" + ], + "output": "add_90", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_40", + "inputs": [ + "add_90" + ], + "output": "rsqrt_40", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_116", + "inputs": [ + "view_54", + "rsqrt_40" + ], + "output": "mul_116", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_6", + "inputs": [ + "mul_114", + "mul_116", + "view_55", + "mul_112", + "sigmoid_8", + "states_17" + ], + "output": "normalized_gated_delta_rule_6", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_84", + "inputs": [ + "normalized_gated_delta_rule_6" + ], + "output": "slice_84", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_17", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_85", + "inputs": [ + "normalized_gated_delta_rule_6" + ], + "output": "slice_85", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_43", + "inputs": [ + "slice_85" + ], + "output": "transpose_43", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_14", + "inputs": [ + "transpose_43" + ], + "output": "clone_14", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_56", + "inputs": [ + "clone_14" + ], + "output": "view_56", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_57", + "inputs": [ + "view_52" + ], + "output": "view_57", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_118", + "inputs": [ + "view_56", + "p_model_model_language_model_layers_8_linear_attn_norm_weight" + ], + "output": "mul_118", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_119", + "inputs": [ + "view_57", + "mul_118" + ], + "output": "mul_119", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_58", + "inputs": [ + "mul_119" + ], + "output": "view_58", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_66", + "inputs": [ + "view_58", + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight" + ], + "output": "linear_66", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_92", + "inputs": [ + "add_85", + "linear_66" + ], + "output": "add_92", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_121", + "inputs": [ + "add_92", + "p_model_model_language_model_layers_8_post_attention_layernorm_weight" + ], + "output": "mul_121", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_21", + "inputs": [ + "mul_121" + ], + "output": "type_as_21", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_67", + "inputs": [ + "type_as_21", + "p_model_model_language_model_layers_8_mlp_gate_proj_weight" + ], + "output": "linear_67", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_68", + "inputs": [ + "type_as_21", + "p_model_model_language_model_layers_8_mlp_up_proj_weight" + ], + "output": "linear_68", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_122", + "inputs": [ + "linear_67", + "linear_68" + ], + "output": "mul_122", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_69", + "inputs": [ + "mul_122", + "p_model_model_language_model_layers_8_mlp_down_proj_weight" + ], + "output": "linear_69", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_95", + "inputs": [ + "add_92", + "linear_69" + ], + "output": "add_95", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_124", + "inputs": [ + "add_95", + "p_model_model_language_model_layers_9_input_layernorm_weight" + ], + "output": "mul_124", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_22", + "inputs": [ + "mul_124" + ], + "output": "type_as_22", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_70", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_70", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_44", + "inputs": [ + "linear_70" + ], + "output": "transpose_44", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_71", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight" + ], + "output": "linear_71", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_59", + "inputs": [ + "linear_71" + ], + "output": "view_59", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_72", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight" + ], + "output": "linear_72", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_73", + "inputs": [ + "type_as_22", + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight" + ], + "output": "linear_73", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_16", + "inputs": [ + "states_18", + "transpose_44" + ], + "output": "cat_16", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_86", + "inputs": [ + "cat_16" + ], + "output": "slice_86", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_18", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_7", + "inputs": [ + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight" + ], + "output": "squeeze_7", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_19", + "inputs": [ + "squeeze_7" + ], + "output": "unsqueeze_19", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_7", + "inputs": [ + "cat_16", + "unsqueeze_19" + ], + "output": "conv1d_7", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_87", + "inputs": [ + "conv1d_7" + ], + "output": "slice_87", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_23", + "inputs": [ + "slice_87" + ], + "output": "silu_23", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_88", + "inputs": [ + "silu_23" + ], + "output": "slice_88", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_45", + "inputs": [ + "slice_88" + ], + "output": "transpose_45", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_89", + "inputs": [ + "transpose_45" + ], + "output": "slice_89", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_90", + "inputs": [ + "transpose_45" + ], + "output": "slice_90", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_91", + "inputs": [ + "transpose_45" + ], + "output": "slice_91", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_60", + "inputs": [ + "slice_89" + ], + "output": "view_60", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_61", + "inputs": [ + "slice_90" + ], + "output": "view_61", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_62", + "inputs": [ + "slice_91" + ], + "output": "view_62", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_9", + "inputs": [ + "linear_72" + ], + "output": "sigmoid_9", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_7", + "inputs": [ + "p_model_model_language_model_layers_9_linear_attn_a_log" + ], + "output": "exp_7", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_11", + "inputs": [ + "exp_7" + ], + "output": "neg_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_98", + "inputs": [ + "linear_73", + "p_model_model_language_model_layers_9_linear_attn_dt_bias" + ], + "output": "add_98", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_7", + "inputs": [ + "add_98" + ], + "output": "softplus_7", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_125", + "inputs": [ + "neg_11", + "softplus_7" + ], + "output": "mul_125", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_126", + "inputs": [ + "view_60" + ], + "output": "mul_126", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_15", + "inputs": [ + "mul_126" + ], + "output": "sum_15", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_99", + "inputs": [ + "sum_15" + ], + "output": "add_99", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_44", + "inputs": [ + "add_99" + ], + "output": "rsqrt_44", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_127", + "inputs": [ + "view_60", + "rsqrt_44" + ], + "output": "mul_127", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_128", + "inputs": [ + "view_61" + ], + "output": "mul_128", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_16", + "inputs": [ + "mul_128" + ], + "output": "sum_16", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_100", + "inputs": [ + "sum_16" + ], + "output": "add_100", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_45", + "inputs": [ + "add_100" + ], + "output": "rsqrt_45", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_129", + "inputs": [ + "view_61", + "rsqrt_45" + ], + "output": "mul_129", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_7", + "inputs": [ + "mul_127", + "mul_129", + "view_62", + "mul_125", + "sigmoid_9", + "states_19" + ], + "output": "normalized_gated_delta_rule_7", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_92", + "inputs": [ + "normalized_gated_delta_rule_7" + ], + "output": "slice_92", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_19", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_93", + "inputs": [ + "normalized_gated_delta_rule_7" + ], + "output": "slice_93", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_46", + "inputs": [ + "slice_93" + ], + "output": "transpose_46", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_15", + "inputs": [ + "transpose_46" + ], + "output": "clone_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_63", + "inputs": [ + "clone_15" + ], + "output": "view_63", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_64", + "inputs": [ + "view_59" + ], + "output": "view_64", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_131", + "inputs": [ + "view_63", + "p_model_model_language_model_layers_9_linear_attn_norm_weight" + ], + "output": "mul_131", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_132", + "inputs": [ + "view_64", + "mul_131" + ], + "output": "mul_132", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_65", + "inputs": [ + "mul_132" + ], + "output": "view_65", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_74", + "inputs": [ + "view_65", + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight" + ], + "output": "linear_74", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_102", + "inputs": [ + "add_95", + "linear_74" + ], + "output": "add_102", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_134", + "inputs": [ + "add_102", + "p_model_model_language_model_layers_9_post_attention_layernorm_weight" + ], + "output": "mul_134", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_23", + "inputs": [ + "mul_134" + ], + "output": "type_as_23", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_75", + "inputs": [ + "type_as_23", + "p_model_model_language_model_layers_9_mlp_gate_proj_weight" + ], + "output": "linear_75", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_76", + "inputs": [ + "type_as_23", + "p_model_model_language_model_layers_9_mlp_up_proj_weight" + ], + "output": "linear_76", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_135", + "inputs": [ + "linear_75", + "linear_76" + ], + "output": "mul_135", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_77", + "inputs": [ + "mul_135", + "p_model_model_language_model_layers_9_mlp_down_proj_weight" + ], + "output": "linear_77", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_105", + "inputs": [ + "add_102", + "linear_77" + ], + "output": "add_105", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_137", + "inputs": [ + "add_105", + "p_model_model_language_model_layers_10_input_layernorm_weight" + ], + "output": "mul_137", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_24", + "inputs": [ + "mul_137" + ], + "output": "type_as_24", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_78", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_78", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_47", + "inputs": [ + "linear_78" + ], + "output": "transpose_47", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_79", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight" + ], + "output": "linear_79", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_66", + "inputs": [ + "linear_79" + ], + "output": "view_66", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_80", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight" + ], + "output": "linear_80", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_81", + "inputs": [ + "type_as_24", + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight" + ], + "output": "linear_81", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_17", + "inputs": [ + "states_20", + "transpose_47" + ], + "output": "cat_17", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_94", + "inputs": [ + "cat_17" + ], + "output": "slice_94", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_20", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_8", + "inputs": [ + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight" + ], + "output": "squeeze_8", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_20", + "inputs": [ + "squeeze_8" + ], + "output": "unsqueeze_20", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_8", + "inputs": [ + "cat_17", + "unsqueeze_20" + ], + "output": "conv1d_8", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_95", + "inputs": [ + "conv1d_8" + ], + "output": "slice_95", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_26", + "inputs": [ + "slice_95" + ], + "output": "silu_26", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_96", + "inputs": [ + "silu_26" + ], + "output": "slice_96", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_48", + "inputs": [ + "slice_96" + ], + "output": "transpose_48", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_97", + "inputs": [ + "transpose_48" + ], + "output": "slice_97", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_98", + "inputs": [ + "transpose_48" + ], + "output": "slice_98", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_99", + "inputs": [ + "transpose_48" + ], + "output": "slice_99", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_67", + "inputs": [ + "slice_97" + ], + "output": "view_67", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_68", + "inputs": [ + "slice_98" + ], + "output": "view_68", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_69", + "inputs": [ + "slice_99" + ], + "output": "view_69", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_10", + "inputs": [ + "linear_80" + ], + "output": "sigmoid_10", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_8", + "inputs": [ + "p_model_model_language_model_layers_10_linear_attn_a_log" + ], + "output": "exp_8", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_12", + "inputs": [ + "exp_8" + ], + "output": "neg_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_108", + "inputs": [ + "linear_81", + "p_model_model_language_model_layers_10_linear_attn_dt_bias" + ], + "output": "add_108", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_8", + "inputs": [ + "add_108" + ], + "output": "softplus_8", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_138", + "inputs": [ + "neg_12", + "softplus_8" + ], + "output": "mul_138", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_139", + "inputs": [ + "view_67" + ], + "output": "mul_139", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_17", + "inputs": [ + "mul_139" + ], + "output": "sum_17", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_109", + "inputs": [ + "sum_17" + ], + "output": "add_109", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_49", + "inputs": [ + "add_109" + ], + "output": "rsqrt_49", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_140", + "inputs": [ + "view_67", + "rsqrt_49" + ], + "output": "mul_140", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_141", + "inputs": [ + "view_68" + ], + "output": "mul_141", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_18", + "inputs": [ + "mul_141" + ], + "output": "sum_18", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_110", + "inputs": [ + "sum_18" + ], + "output": "add_110", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_50", + "inputs": [ + "add_110" + ], + "output": "rsqrt_50", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_142", + "inputs": [ + "view_68", + "rsqrt_50" + ], + "output": "mul_142", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_8", + "inputs": [ + "mul_140", + "mul_142", + "view_69", + "mul_138", + "sigmoid_10", + "states_21" + ], + "output": "normalized_gated_delta_rule_8", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_100", + "inputs": [ + "normalized_gated_delta_rule_8" + ], + "output": "slice_100", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_21", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_101", + "inputs": [ + "normalized_gated_delta_rule_8" + ], + "output": "slice_101", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_49", + "inputs": [ + "slice_101" + ], + "output": "transpose_49", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_16", + "inputs": [ + "transpose_49" + ], + "output": "clone_16", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_70", + "inputs": [ + "clone_16" + ], + "output": "view_70", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_71", + "inputs": [ + "view_66" + ], + "output": "view_71", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_144", + "inputs": [ + "view_70", + "p_model_model_language_model_layers_10_linear_attn_norm_weight" + ], + "output": "mul_144", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_145", + "inputs": [ + "view_71", + "mul_144" + ], + "output": "mul_145", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_72", + "inputs": [ + "mul_145" + ], + "output": "view_72", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_82", + "inputs": [ + "view_72", + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight" + ], + "output": "linear_82", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_112", + "inputs": [ + "add_105", + "linear_82" + ], + "output": "add_112", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_147", + "inputs": [ + "add_112", + "p_model_model_language_model_layers_10_post_attention_layernorm_weight" + ], + "output": "mul_147", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_25", + "inputs": [ + "mul_147" + ], + "output": "type_as_25", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_83", + "inputs": [ + "type_as_25", + "p_model_model_language_model_layers_10_mlp_gate_proj_weight" + ], + "output": "linear_83", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_84", + "inputs": [ + "type_as_25", + "p_model_model_language_model_layers_10_mlp_up_proj_weight" + ], + "output": "linear_84", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_148", + "inputs": [ + "linear_83", + "linear_84" + ], + "output": "mul_148", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_85", + "inputs": [ + "mul_148", + "p_model_model_language_model_layers_10_mlp_down_proj_weight" + ], + "output": "linear_85", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_115", + "inputs": [ + "add_112", + "linear_85" + ], + "output": "add_115", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_150", + "inputs": [ + "add_115", + "p_model_model_language_model_layers_11_input_layernorm_weight" + ], + "output": "mul_150", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_26", + "inputs": [ + "mul_150" + ], + "output": "type_as_26", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_86", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_q_proj_weight" + ], + "output": "linear_86", + "workgroups": [ + 512, + 8, + 1 + ], + "kernel": "kernels/ec17c9e66b2ad1dbed2547b1df93357497b8fca1052cd2375de06b2925123a97.wgsl" + }, + { + "node": "view_73", + "inputs": [ + "linear_86" + ], + "output": "view_73", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl" + }, + { + "node": "slice_102", + "inputs": [ + "view_73" + ], + "output": "slice_102", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl" + }, + { + "node": "slice_103", + "inputs": [ + "view_73" + ], + "output": "slice_103", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl" + }, + { + "node": "clone_17", + "inputs": [ + "slice_103" + ], + "output": "clone_17", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "_unsafe_view_6", + "inputs": [ + "clone_17" + ], + "output": "_unsafe_view_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_74", + "inputs": [ + "slice_102" + ], + "output": "view_74", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_152", + "inputs": [ + "view_74", + "p_model_model_language_model_layers_11_self_attn_q_norm_weight" + ], + "output": "mul_152", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl" + }, + { + "node": "type_as_27", + "inputs": [ + "mul_152" + ], + "output": "type_as_27", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "transpose_50", + "inputs": [ + "type_as_27" + ], + "output": "transpose_50", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl" + }, + { + "node": "linear_87", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_k_proj_weight" + ], + "output": "linear_87", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_75", + "inputs": [ + "linear_87" + ], + "output": "view_75", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_154", + "inputs": [ + "view_75", + "p_model_model_language_model_layers_11_self_attn_k_norm_weight" + ], + "output": "mul_154", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_28", + "inputs": [ + "mul_154" + ], + "output": "type_as_28", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_51", + "inputs": [ + "type_as_28" + ], + "output": "transpose_51", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "linear_88", + "inputs": [ + "type_as_26", + "p_model_model_language_model_layers_11_self_attn_v_proj_weight" + ], + "output": "linear_88", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_76", + "inputs": [ + "linear_88" + ], + "output": "view_76", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_52", + "inputs": [ + "view_76" + ], + "output": "transpose_52", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "unsqueeze_21", + "inputs": [ + "mul" + ], + "output": "unsqueeze_21", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "unsqueeze_22", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_22", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "slice_104", + "inputs": [ + "transpose_50" + ], + "output": "slice_104", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl" + }, + { + "node": "slice_105", + "inputs": [ + "transpose_50" + ], + "output": "slice_105", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl" + }, + { + "node": "slice_106", + "inputs": [ + "transpose_51" + ], + "output": "slice_106", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl" + }, + { + "node": "slice_107", + "inputs": [ + "transpose_51" + ], + "output": "slice_107", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl" + }, + { + "node": "mul_155", + "inputs": [ + "slice_104", + "unsqueeze_21" + ], + "output": "mul_155", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "slice_108", + "inputs": [ + "slice_104" + ], + "output": "slice_108", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl" + }, + { + "node": "slice_109", + "inputs": [ + "slice_104" + ], + "output": "slice_109", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl" + }, + { + "node": "neg_13", + "inputs": [ + "slice_109" + ], + "output": "neg_13", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl" + }, + { + "node": "cat_18", + "inputs": [ + "neg_13", + "slice_108" + ], + "output": "cat_18", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl" + }, + { + "node": "mul_156", + "inputs": [ + "cat_18", + "unsqueeze_22" + ], + "output": "mul_156", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "add_122", + "inputs": [ + "mul_155", + "mul_156" + ], + "output": "add_122", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_157", + "inputs": [ + "slice_106", + "unsqueeze_21" + ], + "output": "mul_157", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "slice_110", + "inputs": [ + "slice_106" + ], + "output": "slice_110", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl" + }, + { + "node": "slice_111", + "inputs": [ + "slice_106" + ], + "output": "slice_111", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl" + }, + { + "node": "neg_14", + "inputs": [ + "slice_111" + ], + "output": "neg_14", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_19", + "inputs": [ + "neg_14", + "slice_110" + ], + "output": "cat_19", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_158", + "inputs": [ + "cat_19", + "unsqueeze_22" + ], + "output": "mul_158", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "add_123", + "inputs": [ + "mul_157", + "mul_158" + ], + "output": "add_123", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "cat_20", + "inputs": [ + "add_122", + "slice_105" + ], + "output": "cat_20", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl" + }, + { + "node": "cat_21", + "inputs": [ + "add_123", + "slice_107" + ], + "output": "cat_21", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cache_update_4", + "inputs": [ + "cat_21", + "cache_position" + ], + "output": "cache_update_4", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_22", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "cache_update_5", + "inputs": [ + "transpose_52", + "cache_position" + ], + "output": "cache_update_5", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_23", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "unsqueeze_23", + "inputs": [ + "cache_update_4" + ], + "output": "unsqueeze_23", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_5", + "inputs": [ + "unsqueeze_23" + ], + "output": "expand_5", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_18", + "inputs": [ + "expand_5" + ], + "output": "clone_18", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_7", + "inputs": [ + "clone_18" + ], + "output": "_unsafe_view_7", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_24", + "inputs": [ + "cache_update_5" + ], + "output": "unsqueeze_24", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_6", + "inputs": [ + "unsqueeze_24" + ], + "output": "expand_6", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_19", + "inputs": [ + "expand_6" + ], + "output": "clone_19", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_8", + "inputs": [ + "clone_19" + ], + "output": "_unsafe_view_8", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_53", + "inputs": [ + "_unsafe_view_7" + ], + "output": "transpose_53", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_5", + "inputs": [ + "cat_20", + "transpose_53" + ], + "output": "matmul_5", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl" + }, + { + "node": "mul_159", + "inputs": [ + "matmul_5" + ], + "output": "mul_159", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl" + }, + { + "node": "add_124", + "inputs": [ + "mul_159", + "attention_mask" + ], + "output": "add_124", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl" + }, + { + "node": "softmax_2", + "inputs": [ + "add_124" + ], + "output": "softmax_2", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl" + }, + { + "node": "matmul_6", + "inputs": [ + "softmax_2", + "_unsafe_view_8" + ], + "output": "matmul_6", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl" + }, + { + "node": "transpose_54", + "inputs": [ + "matmul_6" + ], + "output": "transpose_54", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl" + }, + { + "node": "clone_20", + "inputs": [ + "transpose_54" + ], + "output": "clone_20", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_77", + "inputs": [ + "clone_20" + ], + "output": "view_77", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_11", + "inputs": [ + "_unsafe_view_6" + ], + "output": "sigmoid_11", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl" + }, + { + "node": "mul_160", + "inputs": [ + "view_77", + "sigmoid_11" + ], + "output": "mul_160", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl" + }, + { + "node": "linear_89", + "inputs": [ + "mul_160", + "p_model_model_language_model_layers_11_self_attn_o_proj_weight" + ], + "output": "linear_89", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_125", + "inputs": [ + "add_115", + "linear_89" + ], + "output": "add_125", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_162", + "inputs": [ + "add_125", + "p_model_model_language_model_layers_11_post_attention_layernorm_weight" + ], + "output": "mul_162", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_29", + "inputs": [ + "mul_162" + ], + "output": "type_as_29", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_90", + "inputs": [ + "type_as_29", + "p_model_model_language_model_layers_11_mlp_gate_proj_weight" + ], + "output": "linear_90", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_91", + "inputs": [ + "type_as_29", + "p_model_model_language_model_layers_11_mlp_up_proj_weight" + ], + "output": "linear_91", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_163", + "inputs": [ + "linear_90", + "linear_91" + ], + "output": "mul_163", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_92", + "inputs": [ + "mul_163", + "p_model_model_language_model_layers_11_mlp_down_proj_weight" + ], + "output": "linear_92", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_128", + "inputs": [ + "add_125", + "linear_92" + ], + "output": "add_128", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_165", + "inputs": [ + "add_128", + "p_model_model_language_model_layers_12_input_layernorm_weight" + ], + "output": "mul_165", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_30", + "inputs": [ + "mul_165" + ], + "output": "type_as_30", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_93", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_93", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_55", + "inputs": [ + "linear_93" + ], + "output": "transpose_55", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_94", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight" + ], + "output": "linear_94", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_78", + "inputs": [ + "linear_94" + ], + "output": "view_78", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_95", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight" + ], + "output": "linear_95", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_96", + "inputs": [ + "type_as_30", + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight" + ], + "output": "linear_96", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_22", + "inputs": [ + "states_24", + "transpose_55" + ], + "output": "cat_22", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_112", + "inputs": [ + "cat_22" + ], + "output": "slice_112", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_24", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_9", + "inputs": [ + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight" + ], + "output": "squeeze_9", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_25", + "inputs": [ + "squeeze_9" + ], + "output": "unsqueeze_25", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_9", + "inputs": [ + "cat_22", + "unsqueeze_25" + ], + "output": "conv1d_9", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_113", + "inputs": [ + "conv1d_9" + ], + "output": "slice_113", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_30", + "inputs": [ + "slice_113" + ], + "output": "silu_30", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_114", + "inputs": [ + "silu_30" + ], + "output": "slice_114", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_56", + "inputs": [ + "slice_114" + ], + "output": "transpose_56", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_115", + "inputs": [ + "transpose_56" + ], + "output": "slice_115", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_116", + "inputs": [ + "transpose_56" + ], + "output": "slice_116", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_117", + "inputs": [ + "transpose_56" + ], + "output": "slice_117", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_79", + "inputs": [ + "slice_115" + ], + "output": "view_79", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_80", + "inputs": [ + "slice_116" + ], + "output": "view_80", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_81", + "inputs": [ + "slice_117" + ], + "output": "view_81", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_12", + "inputs": [ + "linear_95" + ], + "output": "sigmoid_12", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_9", + "inputs": [ + "p_model_model_language_model_layers_12_linear_attn_a_log" + ], + "output": "exp_9", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_15", + "inputs": [ + "exp_9" + ], + "output": "neg_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_131", + "inputs": [ + "linear_96", + "p_model_model_language_model_layers_12_linear_attn_dt_bias" + ], + "output": "add_131", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_9", + "inputs": [ + "add_131" + ], + "output": "softplus_9", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_166", + "inputs": [ + "neg_15", + "softplus_9" + ], + "output": "mul_166", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_167", + "inputs": [ + "view_79" + ], + "output": "mul_167", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_19", + "inputs": [ + "mul_167" + ], + "output": "sum_19", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_132", + "inputs": [ + "sum_19" + ], + "output": "add_132", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_58", + "inputs": [ + "add_132" + ], + "output": "rsqrt_58", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_168", + "inputs": [ + "view_79", + "rsqrt_58" + ], + "output": "mul_168", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_169", + "inputs": [ + "view_80" + ], + "output": "mul_169", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_20", + "inputs": [ + "mul_169" + ], + "output": "sum_20", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_133", + "inputs": [ + "sum_20" + ], + "output": "add_133", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_59", + "inputs": [ + "add_133" + ], + "output": "rsqrt_59", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_170", + "inputs": [ + "view_80", + "rsqrt_59" + ], + "output": "mul_170", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_9", + "inputs": [ + "mul_168", + "mul_170", + "view_81", + "mul_166", + "sigmoid_12", + "states_25" + ], + "output": "normalized_gated_delta_rule_9", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_118", + "inputs": [ + "normalized_gated_delta_rule_9" + ], + "output": "slice_118", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_25", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_119", + "inputs": [ + "normalized_gated_delta_rule_9" + ], + "output": "slice_119", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_57", + "inputs": [ + "slice_119" + ], + "output": "transpose_57", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_21", + "inputs": [ + "transpose_57" + ], + "output": "clone_21", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_82", + "inputs": [ + "clone_21" + ], + "output": "view_82", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_83", + "inputs": [ + "view_78" + ], + "output": "view_83", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_172", + "inputs": [ + "view_82", + "p_model_model_language_model_layers_12_linear_attn_norm_weight" + ], + "output": "mul_172", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_173", + "inputs": [ + "view_83", + "mul_172" + ], + "output": "mul_173", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_84", + "inputs": [ + "mul_173" + ], + "output": "view_84", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_97", + "inputs": [ + "view_84", + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight" + ], + "output": "linear_97", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_135", + "inputs": [ + "add_128", + "linear_97" + ], + "output": "add_135", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_175", + "inputs": [ + "add_135", + "p_model_model_language_model_layers_12_post_attention_layernorm_weight" + ], + "output": "mul_175", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_31", + "inputs": [ + "mul_175" + ], + "output": "type_as_31", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_98", + "inputs": [ + "type_as_31", + "p_model_model_language_model_layers_12_mlp_gate_proj_weight" + ], + "output": "linear_98", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_99", + "inputs": [ + "type_as_31", + "p_model_model_language_model_layers_12_mlp_up_proj_weight" + ], + "output": "linear_99", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_176", + "inputs": [ + "linear_98", + "linear_99" + ], + "output": "mul_176", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_100", + "inputs": [ + "mul_176", + "p_model_model_language_model_layers_12_mlp_down_proj_weight" + ], + "output": "linear_100", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_138", + "inputs": [ + "add_135", + "linear_100" + ], + "output": "add_138", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_178", + "inputs": [ + "add_138", + "p_model_model_language_model_layers_13_input_layernorm_weight" + ], + "output": "mul_178", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_32", + "inputs": [ + "mul_178" + ], + "output": "type_as_32", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_101", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_101", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_58", + "inputs": [ + "linear_101" + ], + "output": "transpose_58", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_102", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight" + ], + "output": "linear_102", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_85", + "inputs": [ + "linear_102" + ], + "output": "view_85", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_103", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight" + ], + "output": "linear_103", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_104", + "inputs": [ + "type_as_32", + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight" + ], + "output": "linear_104", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_23", + "inputs": [ + "states_26", + "transpose_58" + ], + "output": "cat_23", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_120", + "inputs": [ + "cat_23" + ], + "output": "slice_120", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_26", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_10", + "inputs": [ + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight" + ], + "output": "squeeze_10", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_26", + "inputs": [ + "squeeze_10" + ], + "output": "unsqueeze_26", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_10", + "inputs": [ + "cat_23", + "unsqueeze_26" + ], + "output": "conv1d_10", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_121", + "inputs": [ + "conv1d_10" + ], + "output": "slice_121", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_33", + "inputs": [ + "slice_121" + ], + "output": "silu_33", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_122", + "inputs": [ + "silu_33" + ], + "output": "slice_122", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_59", + "inputs": [ + "slice_122" + ], + "output": "transpose_59", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_123", + "inputs": [ + "transpose_59" + ], + "output": "slice_123", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_124", + "inputs": [ + "transpose_59" + ], + "output": "slice_124", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_125", + "inputs": [ + "transpose_59" + ], + "output": "slice_125", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_86", + "inputs": [ + "slice_123" + ], + "output": "view_86", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_87", + "inputs": [ + "slice_124" + ], + "output": "view_87", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_88", + "inputs": [ + "slice_125" + ], + "output": "view_88", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_13", + "inputs": [ + "linear_103" + ], + "output": "sigmoid_13", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_10", + "inputs": [ + "p_model_model_language_model_layers_13_linear_attn_a_log" + ], + "output": "exp_10", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_16", + "inputs": [ + "exp_10" + ], + "output": "neg_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_141", + "inputs": [ + "linear_104", + "p_model_model_language_model_layers_13_linear_attn_dt_bias" + ], + "output": "add_141", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_10", + "inputs": [ + "add_141" + ], + "output": "softplus_10", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_179", + "inputs": [ + "neg_16", + "softplus_10" + ], + "output": "mul_179", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_180", + "inputs": [ + "view_86" + ], + "output": "mul_180", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_21", + "inputs": [ + "mul_180" + ], + "output": "sum_21", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_142", + "inputs": [ + "sum_21" + ], + "output": "add_142", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_63", + "inputs": [ + "add_142" + ], + "output": "rsqrt_63", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_181", + "inputs": [ + "view_86", + "rsqrt_63" + ], + "output": "mul_181", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_182", + "inputs": [ + "view_87" + ], + "output": "mul_182", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_22", + "inputs": [ + "mul_182" + ], + "output": "sum_22", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_143", + "inputs": [ + "sum_22" + ], + "output": "add_143", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_64", + "inputs": [ + "add_143" + ], + "output": "rsqrt_64", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_183", + "inputs": [ + "view_87", + "rsqrt_64" + ], + "output": "mul_183", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_10", + "inputs": [ + "mul_181", + "mul_183", + "view_88", + "mul_179", + "sigmoid_13", + "states_27" + ], + "output": "normalized_gated_delta_rule_10", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_126", + "inputs": [ + "normalized_gated_delta_rule_10" + ], + "output": "slice_126", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_27", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_127", + "inputs": [ + "normalized_gated_delta_rule_10" + ], + "output": "slice_127", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_60", + "inputs": [ + "slice_127" + ], + "output": "transpose_60", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_22", + "inputs": [ + "transpose_60" + ], + "output": "clone_22", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_89", + "inputs": [ + "clone_22" + ], + "output": "view_89", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_90", + "inputs": [ + "view_85" + ], + "output": "view_90", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_185", + "inputs": [ + "view_89", + "p_model_model_language_model_layers_13_linear_attn_norm_weight" + ], + "output": "mul_185", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_186", + "inputs": [ + "view_90", + "mul_185" + ], + "output": "mul_186", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_91", + "inputs": [ + "mul_186" + ], + "output": "view_91", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_105", + "inputs": [ + "view_91", + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight" + ], + "output": "linear_105", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_145", + "inputs": [ + "add_138", + "linear_105" + ], + "output": "add_145", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_188", + "inputs": [ + "add_145", + "p_model_model_language_model_layers_13_post_attention_layernorm_weight" + ], + "output": "mul_188", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_33", + "inputs": [ + "mul_188" + ], + "output": "type_as_33", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_106", + "inputs": [ + "type_as_33", + "p_model_model_language_model_layers_13_mlp_gate_proj_weight" + ], + "output": "linear_106", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_107", + "inputs": [ + "type_as_33", + "p_model_model_language_model_layers_13_mlp_up_proj_weight" + ], + "output": "linear_107", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_189", + "inputs": [ + "linear_106", + "linear_107" + ], + "output": "mul_189", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_108", + "inputs": [ + "mul_189", + "p_model_model_language_model_layers_13_mlp_down_proj_weight" + ], + "output": "linear_108", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_148", + "inputs": [ + "add_145", + "linear_108" + ], + "output": "add_148", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_191", + "inputs": [ + "add_148", + "p_model_model_language_model_layers_14_input_layernorm_weight" + ], + "output": "mul_191", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_34", + "inputs": [ + "mul_191" + ], + "output": "type_as_34", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_109", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_109", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_61", + "inputs": [ + "linear_109" + ], + "output": "transpose_61", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_110", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight" + ], + "output": "linear_110", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_92", + "inputs": [ + "linear_110" + ], + "output": "view_92", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_111", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight" + ], + "output": "linear_111", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_112", + "inputs": [ + "type_as_34", + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight" + ], + "output": "linear_112", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_24", + "inputs": [ + "states_28", + "transpose_61" + ], + "output": "cat_24", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_128", + "inputs": [ + "cat_24" + ], + "output": "slice_128", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_28", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_11", + "inputs": [ + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight" + ], + "output": "squeeze_11", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_27", + "inputs": [ + "squeeze_11" + ], + "output": "unsqueeze_27", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_11", + "inputs": [ + "cat_24", + "unsqueeze_27" + ], + "output": "conv1d_11", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_129", + "inputs": [ + "conv1d_11" + ], + "output": "slice_129", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_36", + "inputs": [ + "slice_129" + ], + "output": "silu_36", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_130", + "inputs": [ + "silu_36" + ], + "output": "slice_130", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_62", + "inputs": [ + "slice_130" + ], + "output": "transpose_62", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_131", + "inputs": [ + "transpose_62" + ], + "output": "slice_131", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_132", + "inputs": [ + "transpose_62" + ], + "output": "slice_132", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_133", + "inputs": [ + "transpose_62" + ], + "output": "slice_133", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_93", + "inputs": [ + "slice_131" + ], + "output": "view_93", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_94", + "inputs": [ + "slice_132" + ], + "output": "view_94", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_95", + "inputs": [ + "slice_133" + ], + "output": "view_95", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_14", + "inputs": [ + "linear_111" + ], + "output": "sigmoid_14", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_11", + "inputs": [ + "p_model_model_language_model_layers_14_linear_attn_a_log" + ], + "output": "exp_11", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_17", + "inputs": [ + "exp_11" + ], + "output": "neg_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_151", + "inputs": [ + "linear_112", + "p_model_model_language_model_layers_14_linear_attn_dt_bias" + ], + "output": "add_151", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_11", + "inputs": [ + "add_151" + ], + "output": "softplus_11", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_192", + "inputs": [ + "neg_17", + "softplus_11" + ], + "output": "mul_192", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_193", + "inputs": [ + "view_93" + ], + "output": "mul_193", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_23", + "inputs": [ + "mul_193" + ], + "output": "sum_23", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_152", + "inputs": [ + "sum_23" + ], + "output": "add_152", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_68", + "inputs": [ + "add_152" + ], + "output": "rsqrt_68", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_194", + "inputs": [ + "view_93", + "rsqrt_68" + ], + "output": "mul_194", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_195", + "inputs": [ + "view_94" + ], + "output": "mul_195", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_24", + "inputs": [ + "mul_195" + ], + "output": "sum_24", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_153", + "inputs": [ + "sum_24" + ], + "output": "add_153", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_69", + "inputs": [ + "add_153" + ], + "output": "rsqrt_69", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_196", + "inputs": [ + "view_94", + "rsqrt_69" + ], + "output": "mul_196", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_11", + "inputs": [ + "mul_194", + "mul_196", + "view_95", + "mul_192", + "sigmoid_14", + "states_29" + ], + "output": "normalized_gated_delta_rule_11", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_134", + "inputs": [ + "normalized_gated_delta_rule_11" + ], + "output": "slice_134", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_29", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_135", + "inputs": [ + "normalized_gated_delta_rule_11" + ], + "output": "slice_135", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_63", + "inputs": [ + "slice_135" + ], + "output": "transpose_63", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_23", + "inputs": [ + "transpose_63" + ], + "output": "clone_23", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_96", + "inputs": [ + "clone_23" + ], + "output": "view_96", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_97", + "inputs": [ + "view_92" + ], + "output": "view_97", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_198", + "inputs": [ + "view_96", + "p_model_model_language_model_layers_14_linear_attn_norm_weight" + ], + "output": "mul_198", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_199", + "inputs": [ + "view_97", + "mul_198" + ], + "output": "mul_199", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_98", + "inputs": [ + "mul_199" + ], + "output": "view_98", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_113", + "inputs": [ + "view_98", + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight" + ], + "output": "linear_113", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_155", + "inputs": [ + "add_148", + "linear_113" + ], + "output": "add_155", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_201", + "inputs": [ + "add_155", + "p_model_model_language_model_layers_14_post_attention_layernorm_weight" + ], + "output": "mul_201", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_35", + "inputs": [ + "mul_201" + ], + "output": "type_as_35", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_114", + "inputs": [ + "type_as_35", + "p_model_model_language_model_layers_14_mlp_gate_proj_weight" + ], + "output": "linear_114", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_115", + "inputs": [ + "type_as_35", + "p_model_model_language_model_layers_14_mlp_up_proj_weight" + ], + "output": "linear_115", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_202", + "inputs": [ + "linear_114", + "linear_115" + ], + "output": "mul_202", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_116", + "inputs": [ + "mul_202", + "p_model_model_language_model_layers_14_mlp_down_proj_weight" + ], + "output": "linear_116", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_158", + "inputs": [ + "add_155", + "linear_116" + ], + "output": "add_158", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_204", + "inputs": [ + "add_158", + "p_model_model_language_model_layers_15_input_layernorm_weight" + ], + "output": "mul_204", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_36", + "inputs": [ + "mul_204" + ], + "output": "type_as_36", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_117", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_q_proj_weight" + ], + "output": "linear_117", + "workgroups": [ + 512, + 8, + 1 + ], + "kernel": "kernels/ec17c9e66b2ad1dbed2547b1df93357497b8fca1052cd2375de06b2925123a97.wgsl" + }, + { + "node": "view_99", + "inputs": [ + "linear_117" + ], + "output": "view_99", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl" + }, + { + "node": "slice_136", + "inputs": [ + "view_99" + ], + "output": "slice_136", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl" + }, + { + "node": "slice_137", + "inputs": [ + "view_99" + ], + "output": "slice_137", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl" + }, + { + "node": "clone_24", + "inputs": [ + "slice_137" + ], + "output": "clone_24", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "_unsafe_view_9", + "inputs": [ + "clone_24" + ], + "output": "_unsafe_view_9", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_100", + "inputs": [ + "slice_136" + ], + "output": "view_100", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_206", + "inputs": [ + "view_100", + "p_model_model_language_model_layers_15_self_attn_q_norm_weight" + ], + "output": "mul_206", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl" + }, + { + "node": "type_as_37", + "inputs": [ + "mul_206" + ], + "output": "type_as_37", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "transpose_64", + "inputs": [ + "type_as_37" + ], + "output": "transpose_64", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl" + }, + { + "node": "linear_118", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_k_proj_weight" + ], + "output": "linear_118", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_101", + "inputs": [ + "linear_118" + ], + "output": "view_101", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_208", + "inputs": [ + "view_101", + "p_model_model_language_model_layers_15_self_attn_k_norm_weight" + ], + "output": "mul_208", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_38", + "inputs": [ + "mul_208" + ], + "output": "type_as_38", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_65", + "inputs": [ + "type_as_38" + ], + "output": "transpose_65", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "linear_119", + "inputs": [ + "type_as_36", + "p_model_model_language_model_layers_15_self_attn_v_proj_weight" + ], + "output": "linear_119", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_102", + "inputs": [ + "linear_119" + ], + "output": "view_102", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_66", + "inputs": [ + "view_102" + ], + "output": "transpose_66", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "unsqueeze_28", + "inputs": [ + "mul" + ], + "output": "unsqueeze_28", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "unsqueeze_29", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_29", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "slice_138", + "inputs": [ + "transpose_64" + ], + "output": "slice_138", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl" + }, + { + "node": "slice_139", + "inputs": [ + "transpose_64" + ], + "output": "slice_139", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl" + }, + { + "node": "slice_140", + "inputs": [ + "transpose_65" + ], + "output": "slice_140", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl" + }, + { + "node": "slice_141", + "inputs": [ + "transpose_65" + ], + "output": "slice_141", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl" + }, + { + "node": "mul_209", + "inputs": [ + "slice_138", + "unsqueeze_28" + ], + "output": "mul_209", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "slice_142", + "inputs": [ + "slice_138" + ], + "output": "slice_142", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl" + }, + { + "node": "slice_143", + "inputs": [ + "slice_138" + ], + "output": "slice_143", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl" + }, + { + "node": "neg_18", + "inputs": [ + "slice_143" + ], + "output": "neg_18", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl" + }, + { + "node": "cat_25", + "inputs": [ + "neg_18", + "slice_142" + ], + "output": "cat_25", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl" + }, + { + "node": "mul_210", + "inputs": [ + "cat_25", + "unsqueeze_29" + ], + "output": "mul_210", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "add_165", + "inputs": [ + "mul_209", + "mul_210" + ], + "output": "add_165", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_211", + "inputs": [ + "slice_140", + "unsqueeze_28" + ], + "output": "mul_211", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "slice_144", + "inputs": [ + "slice_140" + ], + "output": "slice_144", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl" + }, + { + "node": "slice_145", + "inputs": [ + "slice_140" + ], + "output": "slice_145", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl" + }, + { + "node": "neg_19", + "inputs": [ + "slice_145" + ], + "output": "neg_19", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_26", + "inputs": [ + "neg_19", + "slice_144" + ], + "output": "cat_26", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_212", + "inputs": [ + "cat_26", + "unsqueeze_29" + ], + "output": "mul_212", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "add_166", + "inputs": [ + "mul_211", + "mul_212" + ], + "output": "add_166", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "cat_27", + "inputs": [ + "add_165", + "slice_139" + ], + "output": "cat_27", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl" + }, + { + "node": "cat_28", + "inputs": [ + "add_166", + "slice_141" + ], + "output": "cat_28", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cache_update_6", + "inputs": [ + "cat_28", + "cache_position" + ], + "output": "cache_update_6", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_30", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "cache_update_7", + "inputs": [ + "transpose_66", + "cache_position" + ], + "output": "cache_update_7", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_31", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "unsqueeze_30", + "inputs": [ + "cache_update_6" + ], + "output": "unsqueeze_30", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_7", + "inputs": [ + "unsqueeze_30" + ], + "output": "expand_7", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_25", + "inputs": [ + "expand_7" + ], + "output": "clone_25", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_10", + "inputs": [ + "clone_25" + ], + "output": "_unsafe_view_10", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_31", + "inputs": [ + "cache_update_7" + ], + "output": "unsqueeze_31", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_8", + "inputs": [ + "unsqueeze_31" + ], + "output": "expand_8", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_26", + "inputs": [ + "expand_8" + ], + "output": "clone_26", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_11", + "inputs": [ + "clone_26" + ], + "output": "_unsafe_view_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_67", + "inputs": [ + "_unsafe_view_10" + ], + "output": "transpose_67", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_7", + "inputs": [ + "cat_27", + "transpose_67" + ], + "output": "matmul_7", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl" + }, + { + "node": "mul_213", + "inputs": [ + "matmul_7" + ], + "output": "mul_213", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl" + }, + { + "node": "add_167", + "inputs": [ + "mul_213", + "attention_mask" + ], + "output": "add_167", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl" + }, + { + "node": "softmax_3", + "inputs": [ + "add_167" + ], + "output": "softmax_3", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl" + }, + { + "node": "matmul_8", + "inputs": [ + "softmax_3", + "_unsafe_view_11" + ], + "output": "matmul_8", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl" + }, + { + "node": "transpose_68", + "inputs": [ + "matmul_8" + ], + "output": "transpose_68", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl" + }, + { + "node": "clone_27", + "inputs": [ + "transpose_68" + ], + "output": "clone_27", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_103", + "inputs": [ + "clone_27" + ], + "output": "view_103", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_15", + "inputs": [ + "_unsafe_view_9" + ], + "output": "sigmoid_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl" + }, + { + "node": "mul_214", + "inputs": [ + "view_103", + "sigmoid_15" + ], + "output": "mul_214", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl" + }, + { + "node": "linear_120", + "inputs": [ + "mul_214", + "p_model_model_language_model_layers_15_self_attn_o_proj_weight" + ], + "output": "linear_120", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_168", + "inputs": [ + "add_158", + "linear_120" + ], + "output": "add_168", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_216", + "inputs": [ + "add_168", + "p_model_model_language_model_layers_15_post_attention_layernorm_weight" + ], + "output": "mul_216", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_39", + "inputs": [ + "mul_216" + ], + "output": "type_as_39", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_121", + "inputs": [ + "type_as_39", + "p_model_model_language_model_layers_15_mlp_gate_proj_weight" + ], + "output": "linear_121", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_122", + "inputs": [ + "type_as_39", + "p_model_model_language_model_layers_15_mlp_up_proj_weight" + ], + "output": "linear_122", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_217", + "inputs": [ + "linear_121", + "linear_122" + ], + "output": "mul_217", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_123", + "inputs": [ + "mul_217", + "p_model_model_language_model_layers_15_mlp_down_proj_weight" + ], + "output": "linear_123", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_171", + "inputs": [ + "add_168", + "linear_123" + ], + "output": "add_171", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_219", + "inputs": [ + "add_171", + "p_model_model_language_model_layers_16_input_layernorm_weight" + ], + "output": "mul_219", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_40", + "inputs": [ + "mul_219" + ], + "output": "type_as_40", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_124", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_124", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_69", + "inputs": [ + "linear_124" + ], + "output": "transpose_69", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_125", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight" + ], + "output": "linear_125", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_104", + "inputs": [ + "linear_125" + ], + "output": "view_104", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_126", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight" + ], + "output": "linear_126", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_127", + "inputs": [ + "type_as_40", + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight" + ], + "output": "linear_127", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_29", + "inputs": [ + "states_32", + "transpose_69" + ], + "output": "cat_29", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_146", + "inputs": [ + "cat_29" + ], + "output": "slice_146", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_32", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_12", + "inputs": [ + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight" + ], + "output": "squeeze_12", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_32", + "inputs": [ + "squeeze_12" + ], + "output": "unsqueeze_32", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_12", + "inputs": [ + "cat_29", + "unsqueeze_32" + ], + "output": "conv1d_12", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_147", + "inputs": [ + "conv1d_12" + ], + "output": "slice_147", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_40", + "inputs": [ + "slice_147" + ], + "output": "silu_40", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_148", + "inputs": [ + "silu_40" + ], + "output": "slice_148", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_70", + "inputs": [ + "slice_148" + ], + "output": "transpose_70", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_149", + "inputs": [ + "transpose_70" + ], + "output": "slice_149", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_150", + "inputs": [ + "transpose_70" + ], + "output": "slice_150", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_151", + "inputs": [ + "transpose_70" + ], + "output": "slice_151", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_105", + "inputs": [ + "slice_149" + ], + "output": "view_105", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_106", + "inputs": [ + "slice_150" + ], + "output": "view_106", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_107", + "inputs": [ + "slice_151" + ], + "output": "view_107", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_16", + "inputs": [ + "linear_126" + ], + "output": "sigmoid_16", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_12", + "inputs": [ + "p_model_model_language_model_layers_16_linear_attn_a_log" + ], + "output": "exp_12", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_20", + "inputs": [ + "exp_12" + ], + "output": "neg_20", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_174", + "inputs": [ + "linear_127", + "p_model_model_language_model_layers_16_linear_attn_dt_bias" + ], + "output": "add_174", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_12", + "inputs": [ + "add_174" + ], + "output": "softplus_12", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_220", + "inputs": [ + "neg_20", + "softplus_12" + ], + "output": "mul_220", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_221", + "inputs": [ + "view_105" + ], + "output": "mul_221", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_25", + "inputs": [ + "mul_221" + ], + "output": "sum_25", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_175", + "inputs": [ + "sum_25" + ], + "output": "add_175", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_77", + "inputs": [ + "add_175" + ], + "output": "rsqrt_77", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_222", + "inputs": [ + "view_105", + "rsqrt_77" + ], + "output": "mul_222", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_223", + "inputs": [ + "view_106" + ], + "output": "mul_223", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_26", + "inputs": [ + "mul_223" + ], + "output": "sum_26", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_176", + "inputs": [ + "sum_26" + ], + "output": "add_176", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_78", + "inputs": [ + "add_176" + ], + "output": "rsqrt_78", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_224", + "inputs": [ + "view_106", + "rsqrt_78" + ], + "output": "mul_224", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_12", + "inputs": [ + "mul_222", + "mul_224", + "view_107", + "mul_220", + "sigmoid_16", + "states_33" + ], + "output": "normalized_gated_delta_rule_12", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_152", + "inputs": [ + "normalized_gated_delta_rule_12" + ], + "output": "slice_152", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_33", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_153", + "inputs": [ + "normalized_gated_delta_rule_12" + ], + "output": "slice_153", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_71", + "inputs": [ + "slice_153" + ], + "output": "transpose_71", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_28", + "inputs": [ + "transpose_71" + ], + "output": "clone_28", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_108", + "inputs": [ + "clone_28" + ], + "output": "view_108", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_109", + "inputs": [ + "view_104" + ], + "output": "view_109", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_226", + "inputs": [ + "view_108", + "p_model_model_language_model_layers_16_linear_attn_norm_weight" + ], + "output": "mul_226", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_227", + "inputs": [ + "view_109", + "mul_226" + ], + "output": "mul_227", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_110", + "inputs": [ + "mul_227" + ], + "output": "view_110", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_128", + "inputs": [ + "view_110", + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight" + ], + "output": "linear_128", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_178", + "inputs": [ + "add_171", + "linear_128" + ], + "output": "add_178", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_229", + "inputs": [ + "add_178", + "p_model_model_language_model_layers_16_post_attention_layernorm_weight" + ], + "output": "mul_229", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_41", + "inputs": [ + "mul_229" + ], + "output": "type_as_41", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_129", + "inputs": [ + "type_as_41", + "p_model_model_language_model_layers_16_mlp_gate_proj_weight" + ], + "output": "linear_129", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_130", + "inputs": [ + "type_as_41", + "p_model_model_language_model_layers_16_mlp_up_proj_weight" + ], + "output": "linear_130", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_230", + "inputs": [ + "linear_129", + "linear_130" + ], + "output": "mul_230", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_131", + "inputs": [ + "mul_230", + "p_model_model_language_model_layers_16_mlp_down_proj_weight" + ], + "output": "linear_131", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_181", + "inputs": [ + "add_178", + "linear_131" + ], + "output": "add_181", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_232", + "inputs": [ + "add_181", + "p_model_model_language_model_layers_17_input_layernorm_weight" + ], + "output": "mul_232", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_42", + "inputs": [ + "mul_232" + ], + "output": "type_as_42", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_132", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_132", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_72", + "inputs": [ + "linear_132" + ], + "output": "transpose_72", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_133", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight" + ], + "output": "linear_133", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_111", + "inputs": [ + "linear_133" + ], + "output": "view_111", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_134", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight" + ], + "output": "linear_134", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_135", + "inputs": [ + "type_as_42", + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight" + ], + "output": "linear_135", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_30", + "inputs": [ + "states_34", + "transpose_72" + ], + "output": "cat_30", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_154", + "inputs": [ + "cat_30" + ], + "output": "slice_154", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_34", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_13", + "inputs": [ + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight" + ], + "output": "squeeze_13", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_33", + "inputs": [ + "squeeze_13" + ], + "output": "unsqueeze_33", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_13", + "inputs": [ + "cat_30", + "unsqueeze_33" + ], + "output": "conv1d_13", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_155", + "inputs": [ + "conv1d_13" + ], + "output": "slice_155", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_43", + "inputs": [ + "slice_155" + ], + "output": "silu_43", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_156", + "inputs": [ + "silu_43" + ], + "output": "slice_156", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_73", + "inputs": [ + "slice_156" + ], + "output": "transpose_73", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_157", + "inputs": [ + "transpose_73" + ], + "output": "slice_157", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_158", + "inputs": [ + "transpose_73" + ], + "output": "slice_158", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_159", + "inputs": [ + "transpose_73" + ], + "output": "slice_159", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_112", + "inputs": [ + "slice_157" + ], + "output": "view_112", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_113", + "inputs": [ + "slice_158" + ], + "output": "view_113", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_114", + "inputs": [ + "slice_159" + ], + "output": "view_114", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_17", + "inputs": [ + "linear_134" + ], + "output": "sigmoid_17", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_13", + "inputs": [ + "p_model_model_language_model_layers_17_linear_attn_a_log" + ], + "output": "exp_13", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_21", + "inputs": [ + "exp_13" + ], + "output": "neg_21", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_184", + "inputs": [ + "linear_135", + "p_model_model_language_model_layers_17_linear_attn_dt_bias" + ], + "output": "add_184", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_13", + "inputs": [ + "add_184" + ], + "output": "softplus_13", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_233", + "inputs": [ + "neg_21", + "softplus_13" + ], + "output": "mul_233", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_234", + "inputs": [ + "view_112" + ], + "output": "mul_234", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_27", + "inputs": [ + "mul_234" + ], + "output": "sum_27", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_185", + "inputs": [ + "sum_27" + ], + "output": "add_185", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_82", + "inputs": [ + "add_185" + ], + "output": "rsqrt_82", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_235", + "inputs": [ + "view_112", + "rsqrt_82" + ], + "output": "mul_235", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_236", + "inputs": [ + "view_113" + ], + "output": "mul_236", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_28", + "inputs": [ + "mul_236" + ], + "output": "sum_28", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_186", + "inputs": [ + "sum_28" + ], + "output": "add_186", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_83", + "inputs": [ + "add_186" + ], + "output": "rsqrt_83", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_237", + "inputs": [ + "view_113", + "rsqrt_83" + ], + "output": "mul_237", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_13", + "inputs": [ + "mul_235", + "mul_237", + "view_114", + "mul_233", + "sigmoid_17", + "states_35" + ], + "output": "normalized_gated_delta_rule_13", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_160", + "inputs": [ + "normalized_gated_delta_rule_13" + ], + "output": "slice_160", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_35", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_161", + "inputs": [ + "normalized_gated_delta_rule_13" + ], + "output": "slice_161", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_74", + "inputs": [ + "slice_161" + ], + "output": "transpose_74", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_29", + "inputs": [ + "transpose_74" + ], + "output": "clone_29", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_115", + "inputs": [ + "clone_29" + ], + "output": "view_115", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_116", + "inputs": [ + "view_111" + ], + "output": "view_116", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_239", + "inputs": [ + "view_115", + "p_model_model_language_model_layers_17_linear_attn_norm_weight" + ], + "output": "mul_239", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_240", + "inputs": [ + "view_116", + "mul_239" + ], + "output": "mul_240", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_117", + "inputs": [ + "mul_240" + ], + "output": "view_117", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_136", + "inputs": [ + "view_117", + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight" + ], + "output": "linear_136", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_188", + "inputs": [ + "add_181", + "linear_136" + ], + "output": "add_188", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_242", + "inputs": [ + "add_188", + "p_model_model_language_model_layers_17_post_attention_layernorm_weight" + ], + "output": "mul_242", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_43", + "inputs": [ + "mul_242" + ], + "output": "type_as_43", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_137", + "inputs": [ + "type_as_43", + "p_model_model_language_model_layers_17_mlp_gate_proj_weight" + ], + "output": "linear_137", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_138", + "inputs": [ + "type_as_43", + "p_model_model_language_model_layers_17_mlp_up_proj_weight" + ], + "output": "linear_138", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_243", + "inputs": [ + "linear_137", + "linear_138" + ], + "output": "mul_243", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_139", + "inputs": [ + "mul_243", + "p_model_model_language_model_layers_17_mlp_down_proj_weight" + ], + "output": "linear_139", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_191", + "inputs": [ + "add_188", + "linear_139" + ], + "output": "add_191", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_245", + "inputs": [ + "add_191", + "p_model_model_language_model_layers_18_input_layernorm_weight" + ], + "output": "mul_245", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_44", + "inputs": [ + "mul_245" + ], + "output": "type_as_44", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_140", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_140", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_75", + "inputs": [ + "linear_140" + ], + "output": "transpose_75", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_141", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight" + ], + "output": "linear_141", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_118", + "inputs": [ + "linear_141" + ], + "output": "view_118", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_142", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight" + ], + "output": "linear_142", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_143", + "inputs": [ + "type_as_44", + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight" + ], + "output": "linear_143", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_31", + "inputs": [ + "states_36", + "transpose_75" + ], + "output": "cat_31", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_162", + "inputs": [ + "cat_31" + ], + "output": "slice_162", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_36", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_14", + "inputs": [ + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight" + ], + "output": "squeeze_14", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_34", + "inputs": [ + "squeeze_14" + ], + "output": "unsqueeze_34", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_14", + "inputs": [ + "cat_31", + "unsqueeze_34" + ], + "output": "conv1d_14", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_163", + "inputs": [ + "conv1d_14" + ], + "output": "slice_163", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_46", + "inputs": [ + "slice_163" + ], + "output": "silu_46", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_164", + "inputs": [ + "silu_46" + ], + "output": "slice_164", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_76", + "inputs": [ + "slice_164" + ], + "output": "transpose_76", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_165", + "inputs": [ + "transpose_76" + ], + "output": "slice_165", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_166", + "inputs": [ + "transpose_76" + ], + "output": "slice_166", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_167", + "inputs": [ + "transpose_76" + ], + "output": "slice_167", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_119", + "inputs": [ + "slice_165" + ], + "output": "view_119", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_120", + "inputs": [ + "slice_166" + ], + "output": "view_120", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_121", + "inputs": [ + "slice_167" + ], + "output": "view_121", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_18", + "inputs": [ + "linear_142" + ], + "output": "sigmoid_18", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_14", + "inputs": [ + "p_model_model_language_model_layers_18_linear_attn_a_log" + ], + "output": "exp_14", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_22", + "inputs": [ + "exp_14" + ], + "output": "neg_22", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_194", + "inputs": [ + "linear_143", + "p_model_model_language_model_layers_18_linear_attn_dt_bias" + ], + "output": "add_194", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_14", + "inputs": [ + "add_194" + ], + "output": "softplus_14", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_246", + "inputs": [ + "neg_22", + "softplus_14" + ], + "output": "mul_246", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_247", + "inputs": [ + "view_119" + ], + "output": "mul_247", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_29", + "inputs": [ + "mul_247" + ], + "output": "sum_29", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_195", + "inputs": [ + "sum_29" + ], + "output": "add_195", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_87", + "inputs": [ + "add_195" + ], + "output": "rsqrt_87", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_248", + "inputs": [ + "view_119", + "rsqrt_87" + ], + "output": "mul_248", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_249", + "inputs": [ + "view_120" + ], + "output": "mul_249", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_30", + "inputs": [ + "mul_249" + ], + "output": "sum_30", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_196", + "inputs": [ + "sum_30" + ], + "output": "add_196", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_88", + "inputs": [ + "add_196" + ], + "output": "rsqrt_88", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_250", + "inputs": [ + "view_120", + "rsqrt_88" + ], + "output": "mul_250", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_14", + "inputs": [ + "mul_248", + "mul_250", + "view_121", + "mul_246", + "sigmoid_18", + "states_37" + ], + "output": "normalized_gated_delta_rule_14", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_168", + "inputs": [ + "normalized_gated_delta_rule_14" + ], + "output": "slice_168", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_37", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_169", + "inputs": [ + "normalized_gated_delta_rule_14" + ], + "output": "slice_169", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_77", + "inputs": [ + "slice_169" + ], + "output": "transpose_77", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_30", + "inputs": [ + "transpose_77" + ], + "output": "clone_30", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_122", + "inputs": [ + "clone_30" + ], + "output": "view_122", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_123", + "inputs": [ + "view_118" + ], + "output": "view_123", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_252", + "inputs": [ + "view_122", + "p_model_model_language_model_layers_18_linear_attn_norm_weight" + ], + "output": "mul_252", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_253", + "inputs": [ + "view_123", + "mul_252" + ], + "output": "mul_253", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_124", + "inputs": [ + "mul_253" + ], + "output": "view_124", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_144", + "inputs": [ + "view_124", + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight" + ], + "output": "linear_144", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_198", + "inputs": [ + "add_191", + "linear_144" + ], + "output": "add_198", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_255", + "inputs": [ + "add_198", + "p_model_model_language_model_layers_18_post_attention_layernorm_weight" + ], + "output": "mul_255", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_45", + "inputs": [ + "mul_255" + ], + "output": "type_as_45", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_145", + "inputs": [ + "type_as_45", + "p_model_model_language_model_layers_18_mlp_gate_proj_weight" + ], + "output": "linear_145", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_146", + "inputs": [ + "type_as_45", + "p_model_model_language_model_layers_18_mlp_up_proj_weight" + ], + "output": "linear_146", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_256", + "inputs": [ + "linear_145", + "linear_146" + ], + "output": "mul_256", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_147", + "inputs": [ + "mul_256", + "p_model_model_language_model_layers_18_mlp_down_proj_weight" + ], + "output": "linear_147", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_201", + "inputs": [ + "add_198", + "linear_147" + ], + "output": "add_201", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_258", + "inputs": [ + "add_201", + "p_model_model_language_model_layers_19_input_layernorm_weight" + ], + "output": "mul_258", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_46", + "inputs": [ + "mul_258" + ], + "output": "type_as_46", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_148", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_q_proj_weight" + ], + "output": "linear_148", + "workgroups": [ + 512, + 8, + 1 + ], + "kernel": "kernels/ec17c9e66b2ad1dbed2547b1df93357497b8fca1052cd2375de06b2925123a97.wgsl" + }, + { + "node": "view_125", + "inputs": [ + "linear_148" + ], + "output": "view_125", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl" + }, + { + "node": "slice_170", + "inputs": [ + "view_125" + ], + "output": "slice_170", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl" + }, + { + "node": "slice_171", + "inputs": [ + "view_125" + ], + "output": "slice_171", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl" + }, + { + "node": "clone_31", + "inputs": [ + "slice_171" + ], + "output": "clone_31", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "_unsafe_view_12", + "inputs": [ + "clone_31" + ], + "output": "_unsafe_view_12", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_126", + "inputs": [ + "slice_170" + ], + "output": "view_126", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_260", + "inputs": [ + "view_126", + "p_model_model_language_model_layers_19_self_attn_q_norm_weight" + ], + "output": "mul_260", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl" + }, + { + "node": "type_as_47", + "inputs": [ + "mul_260" + ], + "output": "type_as_47", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "transpose_78", + "inputs": [ + "type_as_47" + ], + "output": "transpose_78", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl" + }, + { + "node": "linear_149", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_k_proj_weight" + ], + "output": "linear_149", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_127", + "inputs": [ + "linear_149" + ], + "output": "view_127", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_262", + "inputs": [ + "view_127", + "p_model_model_language_model_layers_19_self_attn_k_norm_weight" + ], + "output": "mul_262", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_48", + "inputs": [ + "mul_262" + ], + "output": "type_as_48", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_79", + "inputs": [ + "type_as_48" + ], + "output": "transpose_79", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "linear_150", + "inputs": [ + "type_as_46", + "p_model_model_language_model_layers_19_self_attn_v_proj_weight" + ], + "output": "linear_150", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_128", + "inputs": [ + "linear_150" + ], + "output": "view_128", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_80", + "inputs": [ + "view_128" + ], + "output": "transpose_80", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "unsqueeze_35", + "inputs": [ + "mul" + ], + "output": "unsqueeze_35", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "unsqueeze_36", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_36", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "slice_172", + "inputs": [ + "transpose_78" + ], + "output": "slice_172", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl" + }, + { + "node": "slice_173", + "inputs": [ + "transpose_78" + ], + "output": "slice_173", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl" + }, + { + "node": "slice_174", + "inputs": [ + "transpose_79" + ], + "output": "slice_174", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl" + }, + { + "node": "slice_175", + "inputs": [ + "transpose_79" + ], + "output": "slice_175", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl" + }, + { + "node": "mul_263", + "inputs": [ + "slice_172", + "unsqueeze_35" + ], + "output": "mul_263", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "slice_176", + "inputs": [ + "slice_172" + ], + "output": "slice_176", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl" + }, + { + "node": "slice_177", + "inputs": [ + "slice_172" + ], + "output": "slice_177", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl" + }, + { + "node": "neg_23", + "inputs": [ + "slice_177" + ], + "output": "neg_23", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl" + }, + { + "node": "cat_32", + "inputs": [ + "neg_23", + "slice_176" + ], + "output": "cat_32", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl" + }, + { + "node": "mul_264", + "inputs": [ + "cat_32", + "unsqueeze_36" + ], + "output": "mul_264", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "add_208", + "inputs": [ + "mul_263", + "mul_264" + ], + "output": "add_208", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_265", + "inputs": [ + "slice_174", + "unsqueeze_35" + ], + "output": "mul_265", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "slice_178", + "inputs": [ + "slice_174" + ], + "output": "slice_178", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl" + }, + { + "node": "slice_179", + "inputs": [ + "slice_174" + ], + "output": "slice_179", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl" + }, + { + "node": "neg_24", + "inputs": [ + "slice_179" + ], + "output": "neg_24", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_33", + "inputs": [ + "neg_24", + "slice_178" + ], + "output": "cat_33", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_266", + "inputs": [ + "cat_33", + "unsqueeze_36" + ], + "output": "mul_266", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "add_209", + "inputs": [ + "mul_265", + "mul_266" + ], + "output": "add_209", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "cat_34", + "inputs": [ + "add_208", + "slice_173" + ], + "output": "cat_34", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl" + }, + { + "node": "cat_35", + "inputs": [ + "add_209", + "slice_175" + ], + "output": "cat_35", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cache_update_8", + "inputs": [ + "cat_35", + "cache_position" + ], + "output": "cache_update_8", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_38", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "cache_update_9", + "inputs": [ + "transpose_80", + "cache_position" + ], + "output": "cache_update_9", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_39", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "unsqueeze_37", + "inputs": [ + "cache_update_8" + ], + "output": "unsqueeze_37", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_9", + "inputs": [ + "unsqueeze_37" + ], + "output": "expand_9", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_32", + "inputs": [ + "expand_9" + ], + "output": "clone_32", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_13", + "inputs": [ + "clone_32" + ], + "output": "_unsafe_view_13", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_38", + "inputs": [ + "cache_update_9" + ], + "output": "unsqueeze_38", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_10", + "inputs": [ + "unsqueeze_38" + ], + "output": "expand_10", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_33", + "inputs": [ + "expand_10" + ], + "output": "clone_33", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_14", + "inputs": [ + "clone_33" + ], + "output": "_unsafe_view_14", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_81", + "inputs": [ + "_unsafe_view_13" + ], + "output": "transpose_81", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_9", + "inputs": [ + "cat_34", + "transpose_81" + ], + "output": "matmul_9", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl" + }, + { + "node": "mul_267", + "inputs": [ + "matmul_9" + ], + "output": "mul_267", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl" + }, + { + "node": "add_210", + "inputs": [ + "mul_267", + "attention_mask" + ], + "output": "add_210", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl" + }, + { + "node": "softmax_4", + "inputs": [ + "add_210" + ], + "output": "softmax_4", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl" + }, + { + "node": "matmul_10", + "inputs": [ + "softmax_4", + "_unsafe_view_14" + ], + "output": "matmul_10", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl" + }, + { + "node": "transpose_82", + "inputs": [ + "matmul_10" + ], + "output": "transpose_82", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl" + }, + { + "node": "clone_34", + "inputs": [ + "transpose_82" + ], + "output": "clone_34", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_129", + "inputs": [ + "clone_34" + ], + "output": "view_129", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_19", + "inputs": [ + "_unsafe_view_12" + ], + "output": "sigmoid_19", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl" + }, + { + "node": "mul_268", + "inputs": [ + "view_129", + "sigmoid_19" + ], + "output": "mul_268", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl" + }, + { + "node": "linear_151", + "inputs": [ + "mul_268", + "p_model_model_language_model_layers_19_self_attn_o_proj_weight" + ], + "output": "linear_151", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_211", + "inputs": [ + "add_201", + "linear_151" + ], + "output": "add_211", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_270", + "inputs": [ + "add_211", + "p_model_model_language_model_layers_19_post_attention_layernorm_weight" + ], + "output": "mul_270", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_49", + "inputs": [ + "mul_270" + ], + "output": "type_as_49", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_152", + "inputs": [ + "type_as_49", + "p_model_model_language_model_layers_19_mlp_gate_proj_weight" + ], + "output": "linear_152", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_153", + "inputs": [ + "type_as_49", + "p_model_model_language_model_layers_19_mlp_up_proj_weight" + ], + "output": "linear_153", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_271", + "inputs": [ + "linear_152", + "linear_153" + ], + "output": "mul_271", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_154", + "inputs": [ + "mul_271", + "p_model_model_language_model_layers_19_mlp_down_proj_weight" + ], + "output": "linear_154", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_214", + "inputs": [ + "add_211", + "linear_154" + ], + "output": "add_214", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_273", + "inputs": [ + "add_214", + "p_model_model_language_model_layers_20_input_layernorm_weight" + ], + "output": "mul_273", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_50", + "inputs": [ + "mul_273" + ], + "output": "type_as_50", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_155", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_155", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_83", + "inputs": [ + "linear_155" + ], + "output": "transpose_83", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_156", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight" + ], + "output": "linear_156", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_130", + "inputs": [ + "linear_156" + ], + "output": "view_130", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_157", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight" + ], + "output": "linear_157", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_158", + "inputs": [ + "type_as_50", + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight" + ], + "output": "linear_158", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_36", + "inputs": [ + "states_40", + "transpose_83" + ], + "output": "cat_36", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_180", + "inputs": [ + "cat_36" + ], + "output": "slice_180", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_40", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_15", + "inputs": [ + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight" + ], + "output": "squeeze_15", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_39", + "inputs": [ + "squeeze_15" + ], + "output": "unsqueeze_39", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_15", + "inputs": [ + "cat_36", + "unsqueeze_39" + ], + "output": "conv1d_15", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_181", + "inputs": [ + "conv1d_15" + ], + "output": "slice_181", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_50", + "inputs": [ + "slice_181" + ], + "output": "silu_50", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_182", + "inputs": [ + "silu_50" + ], + "output": "slice_182", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_84", + "inputs": [ + "slice_182" + ], + "output": "transpose_84", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_183", + "inputs": [ + "transpose_84" + ], + "output": "slice_183", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_184", + "inputs": [ + "transpose_84" + ], + "output": "slice_184", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_185", + "inputs": [ + "transpose_84" + ], + "output": "slice_185", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_131", + "inputs": [ + "slice_183" + ], + "output": "view_131", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_132", + "inputs": [ + "slice_184" + ], + "output": "view_132", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_133", + "inputs": [ + "slice_185" + ], + "output": "view_133", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_20", + "inputs": [ + "linear_157" + ], + "output": "sigmoid_20", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_15", + "inputs": [ + "p_model_model_language_model_layers_20_linear_attn_a_log" + ], + "output": "exp_15", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_25", + "inputs": [ + "exp_15" + ], + "output": "neg_25", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_217", + "inputs": [ + "linear_158", + "p_model_model_language_model_layers_20_linear_attn_dt_bias" + ], + "output": "add_217", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_15", + "inputs": [ + "add_217" + ], + "output": "softplus_15", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_274", + "inputs": [ + "neg_25", + "softplus_15" + ], + "output": "mul_274", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_275", + "inputs": [ + "view_131" + ], + "output": "mul_275", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_31", + "inputs": [ + "mul_275" + ], + "output": "sum_31", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_218", + "inputs": [ + "sum_31" + ], + "output": "add_218", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_96", + "inputs": [ + "add_218" + ], + "output": "rsqrt_96", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_276", + "inputs": [ + "view_131", + "rsqrt_96" + ], + "output": "mul_276", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_277", + "inputs": [ + "view_132" + ], + "output": "mul_277", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_32", + "inputs": [ + "mul_277" + ], + "output": "sum_32", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_219", + "inputs": [ + "sum_32" + ], + "output": "add_219", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_97", + "inputs": [ + "add_219" + ], + "output": "rsqrt_97", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_278", + "inputs": [ + "view_132", + "rsqrt_97" + ], + "output": "mul_278", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_15", + "inputs": [ + "mul_276", + "mul_278", + "view_133", + "mul_274", + "sigmoid_20", + "states_41" + ], + "output": "normalized_gated_delta_rule_15", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_186", + "inputs": [ + "normalized_gated_delta_rule_15" + ], + "output": "slice_186", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_41", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_187", + "inputs": [ + "normalized_gated_delta_rule_15" + ], + "output": "slice_187", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_85", + "inputs": [ + "slice_187" + ], + "output": "transpose_85", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_35", + "inputs": [ + "transpose_85" + ], + "output": "clone_35", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_134", + "inputs": [ + "clone_35" + ], + "output": "view_134", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_135", + "inputs": [ + "view_130" + ], + "output": "view_135", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_280", + "inputs": [ + "view_134", + "p_model_model_language_model_layers_20_linear_attn_norm_weight" + ], + "output": "mul_280", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_281", + "inputs": [ + "view_135", + "mul_280" + ], + "output": "mul_281", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_136", + "inputs": [ + "mul_281" + ], + "output": "view_136", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_159", + "inputs": [ + "view_136", + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight" + ], + "output": "linear_159", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_221", + "inputs": [ + "add_214", + "linear_159" + ], + "output": "add_221", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_283", + "inputs": [ + "add_221", + "p_model_model_language_model_layers_20_post_attention_layernorm_weight" + ], + "output": "mul_283", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_51", + "inputs": [ + "mul_283" + ], + "output": "type_as_51", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_160", + "inputs": [ + "type_as_51", + "p_model_model_language_model_layers_20_mlp_gate_proj_weight" + ], + "output": "linear_160", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_161", + "inputs": [ + "type_as_51", + "p_model_model_language_model_layers_20_mlp_up_proj_weight" + ], + "output": "linear_161", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_284", + "inputs": [ + "linear_160", + "linear_161" + ], + "output": "mul_284", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_162", + "inputs": [ + "mul_284", + "p_model_model_language_model_layers_20_mlp_down_proj_weight" + ], + "output": "linear_162", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_224", + "inputs": [ + "add_221", + "linear_162" + ], + "output": "add_224", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_286", + "inputs": [ + "add_224", + "p_model_model_language_model_layers_21_input_layernorm_weight" + ], + "output": "mul_286", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_52", + "inputs": [ + "mul_286" + ], + "output": "type_as_52", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_163", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_163", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_86", + "inputs": [ + "linear_163" + ], + "output": "transpose_86", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_164", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight" + ], + "output": "linear_164", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_137", + "inputs": [ + "linear_164" + ], + "output": "view_137", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_165", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight" + ], + "output": "linear_165", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_166", + "inputs": [ + "type_as_52", + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight" + ], + "output": "linear_166", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_37", + "inputs": [ + "states_42", + "transpose_86" + ], + "output": "cat_37", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_188", + "inputs": [ + "cat_37" + ], + "output": "slice_188", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_42", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_16", + "inputs": [ + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight" + ], + "output": "squeeze_16", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_40", + "inputs": [ + "squeeze_16" + ], + "output": "unsqueeze_40", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_16", + "inputs": [ + "cat_37", + "unsqueeze_40" + ], + "output": "conv1d_16", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_189", + "inputs": [ + "conv1d_16" + ], + "output": "slice_189", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_53", + "inputs": [ + "slice_189" + ], + "output": "silu_53", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_190", + "inputs": [ + "silu_53" + ], + "output": "slice_190", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_87", + "inputs": [ + "slice_190" + ], + "output": "transpose_87", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_191", + "inputs": [ + "transpose_87" + ], + "output": "slice_191", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_192", + "inputs": [ + "transpose_87" + ], + "output": "slice_192", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_193", + "inputs": [ + "transpose_87" + ], + "output": "slice_193", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_138", + "inputs": [ + "slice_191" + ], + "output": "view_138", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_139", + "inputs": [ + "slice_192" + ], + "output": "view_139", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_140", + "inputs": [ + "slice_193" + ], + "output": "view_140", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_21", + "inputs": [ + "linear_165" + ], + "output": "sigmoid_21", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_16", + "inputs": [ + "p_model_model_language_model_layers_21_linear_attn_a_log" + ], + "output": "exp_16", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_26", + "inputs": [ + "exp_16" + ], + "output": "neg_26", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_227", + "inputs": [ + "linear_166", + "p_model_model_language_model_layers_21_linear_attn_dt_bias" + ], + "output": "add_227", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_16", + "inputs": [ + "add_227" + ], + "output": "softplus_16", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_287", + "inputs": [ + "neg_26", + "softplus_16" + ], + "output": "mul_287", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_288", + "inputs": [ + "view_138" + ], + "output": "mul_288", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_33", + "inputs": [ + "mul_288" + ], + "output": "sum_33", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_228", + "inputs": [ + "sum_33" + ], + "output": "add_228", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_101", + "inputs": [ + "add_228" + ], + "output": "rsqrt_101", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_289", + "inputs": [ + "view_138", + "rsqrt_101" + ], + "output": "mul_289", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_290", + "inputs": [ + "view_139" + ], + "output": "mul_290", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_34", + "inputs": [ + "mul_290" + ], + "output": "sum_34", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_229", + "inputs": [ + "sum_34" + ], + "output": "add_229", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_102", + "inputs": [ + "add_229" + ], + "output": "rsqrt_102", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_291", + "inputs": [ + "view_139", + "rsqrt_102" + ], + "output": "mul_291", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_16", + "inputs": [ + "mul_289", + "mul_291", + "view_140", + "mul_287", + "sigmoid_21", + "states_43" + ], + "output": "normalized_gated_delta_rule_16", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_194", + "inputs": [ + "normalized_gated_delta_rule_16" + ], + "output": "slice_194", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_43", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_195", + "inputs": [ + "normalized_gated_delta_rule_16" + ], + "output": "slice_195", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_88", + "inputs": [ + "slice_195" + ], + "output": "transpose_88", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_36", + "inputs": [ + "transpose_88" + ], + "output": "clone_36", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_141", + "inputs": [ + "clone_36" + ], + "output": "view_141", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_142", + "inputs": [ + "view_137" + ], + "output": "view_142", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_293", + "inputs": [ + "view_141", + "p_model_model_language_model_layers_21_linear_attn_norm_weight" + ], + "output": "mul_293", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_294", + "inputs": [ + "view_142", + "mul_293" + ], + "output": "mul_294", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_143", + "inputs": [ + "mul_294" + ], + "output": "view_143", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_167", + "inputs": [ + "view_143", + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight" + ], + "output": "linear_167", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_231", + "inputs": [ + "add_224", + "linear_167" + ], + "output": "add_231", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_296", + "inputs": [ + "add_231", + "p_model_model_language_model_layers_21_post_attention_layernorm_weight" + ], + "output": "mul_296", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_53", + "inputs": [ + "mul_296" + ], + "output": "type_as_53", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_168", + "inputs": [ + "type_as_53", + "p_model_model_language_model_layers_21_mlp_gate_proj_weight" + ], + "output": "linear_168", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_169", + "inputs": [ + "type_as_53", + "p_model_model_language_model_layers_21_mlp_up_proj_weight" + ], + "output": "linear_169", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_297", + "inputs": [ + "linear_168", + "linear_169" + ], + "output": "mul_297", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_170", + "inputs": [ + "mul_297", + "p_model_model_language_model_layers_21_mlp_down_proj_weight" + ], + "output": "linear_170", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_234", + "inputs": [ + "add_231", + "linear_170" + ], + "output": "add_234", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_299", + "inputs": [ + "add_234", + "p_model_model_language_model_layers_22_input_layernorm_weight" + ], + "output": "mul_299", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_54", + "inputs": [ + "mul_299" + ], + "output": "type_as_54", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_171", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight" + ], + "output": "linear_171", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "transpose_89", + "inputs": [ + "linear_171" + ], + "output": "transpose_89", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a831fed0324f7532d7905d47c499e6a3deb56fe99d0dbcc91193b351efa797db.wgsl" + }, + { + "node": "linear_172", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight" + ], + "output": "linear_172", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "view_144", + "inputs": [ + "linear_172" + ], + "output": "view_144", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_173", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight" + ], + "output": "linear_173", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "linear_174", + "inputs": [ + "type_as_54", + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight" + ], + "output": "linear_174", + "workgroups": [ + 2, + 8, + 1 + ], + "kernel": "kernels/94a2c2e4ddc65deb44fa82c2d58cedd197463b1fdae696a18ace95efbba96118.wgsl" + }, + { + "node": "cat_38", + "inputs": [ + "states_44", + "transpose_89" + ], + "output": "cat_38", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/9cd8236a30e65989f2ed9c7afcfcf2369b6036ade2a7d81c8e203c2789178074.wgsl" + }, + { + "node": "slice_196", + "inputs": [ + "cat_38" + ], + "output": "slice_196", + "workgroups": [ + 384, + 1, + 1 + ], + "inPlaceOf": "states_44", + "kernel": "kernels/bd8a785d4fbf09918f149c7eb5f34bd25f9358bf3412e27799a7c65436c71759.wgsl" + }, + { + "node": "squeeze_17", + "inputs": [ + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight" + ], + "output": "squeeze_17", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "unsqueeze_41", + "inputs": [ + "squeeze_17" + ], + "output": "unsqueeze_41", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/8898353d0c367a3982a48d416f6777c3ce7a854572eeaf55843f3e7ee458c65d.wgsl" + }, + { + "node": "conv1d_17", + "inputs": [ + "cat_38", + "unsqueeze_41" + ], + "output": "conv1d_17", + "workgroups": [ + 6816, + 1, + 1 + ], + "kernel": "kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl" + }, + { + "node": "slice_197", + "inputs": [ + "conv1d_17" + ], + "output": "slice_197", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/2af7517eb26022ada8f8870fd9e1e1ef3da66b9c466336ee18d5295957820b27.wgsl" + }, + { + "node": "silu_56", + "inputs": [ + "slice_197" + ], + "output": "silu_56", + "workgroups": [ + 6528, + 1, + 1 + ], + "kernel": "kernels/827ffce28b59c5790739e7f9624b4ef6ebf876973f7ba942702dd8872f47fcd5.wgsl" + }, + { + "node": "slice_198", + "inputs": [ + "silu_56" + ], + "output": "slice_198", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/a16a539c1a662c846d6c661e572b0b8e19335f9ef41742f784d738bcfd3cd7a6.wgsl" + }, + { + "node": "transpose_90", + "inputs": [ + "slice_198" + ], + "output": "transpose_90", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/3b2066052a48ffaf36270fc0f07d7725e7146f7d0cabef87ecc8507eda259a1d.wgsl" + }, + { + "node": "slice_199", + "inputs": [ + "transpose_90" + ], + "output": "slice_199", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/ac173d038b5767711ad9f7cafbceb9ca3ec84aaeb3d07a3037e7cd0f83fead2c.wgsl" + }, + { + "node": "slice_200", + "inputs": [ + "transpose_90" + ], + "output": "slice_200", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4b098a370a6c993f2c974bd5afcc00f7e3686a600c458a060c7e7db3193789ba.wgsl" + }, + { + "node": "slice_201", + "inputs": [ + "transpose_90" + ], + "output": "slice_201", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3560fe2bb07bf6fb92598b9f9c006029892f16dcb55b418973ed89b2b5086b1b.wgsl" + }, + { + "node": "view_145", + "inputs": [ + "slice_199" + ], + "output": "view_145", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_146", + "inputs": [ + "slice_200" + ], + "output": "view_146", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_147", + "inputs": [ + "slice_201" + ], + "output": "view_147", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_22", + "inputs": [ + "linear_173" + ], + "output": "sigmoid_22", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/a2e242b97ac8ec546c9f91b5af599c2231915bdabb57d55cdc21f61a49c21007.wgsl" + }, + { + "node": "exp_17", + "inputs": [ + "p_model_model_language_model_layers_22_linear_attn_a_log" + ], + "output": "exp_17", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/51fd4d798491c6a80daff4c18b0495926b7f62269dfc3a78a327faa52ba2a759.wgsl" + }, + { + "node": "neg_27", + "inputs": [ + "exp_17" + ], + "output": "neg_27", + "workgroups": [ + 1, + 1, + 1 + ], + "kernel": "kernels/8d0a37e497bcb37e2d5a1746fba59fd69680ed8eeada4835c5d0eeef840d57ab.wgsl" + }, + { + "node": "add_237", + "inputs": [ + "linear_174", + "p_model_model_language_model_layers_22_linear_attn_dt_bias" + ], + "output": "add_237", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/793b4c977feaf93abb2f6e92796d4971ecf3176f10459317fb7a98b028007c01.wgsl" + }, + { + "node": "softplus_17", + "inputs": [ + "add_237" + ], + "output": "softplus_17", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/9d12ba7fd89692e99bb291808c5a80ffd5b95478671dde2c936fc3deb8383fa0.wgsl" + }, + { + "node": "mul_300", + "inputs": [ + "neg_27", + "softplus_17" + ], + "output": "mul_300", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/c342e2d29647509fe0f6ac1e2dbbe74032dbe9ecd6229c03557b86f160381d2e.wgsl" + }, + { + "node": "mul_301", + "inputs": [ + "view_145" + ], + "output": "mul_301", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_35", + "inputs": [ + "mul_301" + ], + "output": "sum_35", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_238", + "inputs": [ + "sum_35" + ], + "output": "add_238", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_106", + "inputs": [ + "add_238" + ], + "output": "rsqrt_106", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_302", + "inputs": [ + "view_145", + "rsqrt_106" + ], + "output": "mul_302", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "mul_303", + "inputs": [ + "view_146" + ], + "output": "mul_303", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f5e16141122c02a1ec56f8155742fd5314ab581eac810352c06abea3f9c57690.wgsl" + }, + { + "node": "sum_36", + "inputs": [ + "mul_303" + ], + "output": "sum_36", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/32cb7d055e8ecf035e10d05724e64544393bd3916079992a3d8dce427bb14181.wgsl" + }, + { + "node": "add_239", + "inputs": [ + "sum_36" + ], + "output": "add_239", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl" + }, + { + "node": "rsqrt_107", + "inputs": [ + "add_239" + ], + "output": "rsqrt_107", + "workgroups": [ + 16, + 1, + 1 + ], + "kernel": "kernels/64f29e6a6e8772f8cfc7449941fd85f70caff7c7e20f316c39b394500e9a8ce1.wgsl" + }, + { + "node": "mul_304", + "inputs": [ + "view_146", + "rsqrt_107" + ], + "output": "mul_304", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/cd74e23e4f4177562ffb4c00641720b63d154cea3600f6177e01985d74784f37.wgsl" + }, + { + "node": "normalized_gated_delta_rule_17", + "inputs": [ + "mul_302", + "mul_304", + "view_147", + "mul_300", + "sigmoid_22", + "states_45" + ], + "output": "normalized_gated_delta_rule_17", + "workgroups": [ + 128, + 16, + 1 + ], + "kernel": "kernels/a62f6b62277fe048d6bac44a25a2e61399e7e2eab103fccd3a23c29a3c827856.wgsl" + }, + { + "node": "slice_202", + "inputs": [ + "normalized_gated_delta_rule_17" + ], + "output": "slice_202", + "workgroups": [ + 4096, + 1, + 1 + ], + "inPlaceOf": "states_45", + "kernel": "kernels/bb7f03e6a2277dc56084e9130086507be58871253867c0ce8ad60ee5ce4521b6.wgsl" + }, + { + "node": "slice_203", + "inputs": [ + "normalized_gated_delta_rule_17" + ], + "output": "slice_203", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9701df2bcd72ed6a0b72dca81006d9fcc2336e0250fbd66cf37d4fd80667358f.wgsl" + }, + { + "node": "transpose_91", + "inputs": [ + "slice_203" + ], + "output": "transpose_91", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/72474f821f837da4ebaab4cc925fdac78b707346be174a7c033c4c6518935abc.wgsl" + }, + { + "node": "clone_37", + "inputs": [ + "transpose_91" + ], + "output": "clone_37", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_148", + "inputs": [ + "clone_37" + ], + "output": "view_148", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_149", + "inputs": [ + "view_144" + ], + "output": "view_149", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_306", + "inputs": [ + "view_148", + "p_model_model_language_model_layers_22_linear_attn_norm_weight" + ], + "output": "mul_306", + "workgroups": [ + 1024, + 1, + 1 + ], + "kernel": "kernels/c3b8a95df30cf49f5ba2a9aa459e227338c340989ea076b9cf7fc3d09ba103a4.wgsl" + }, + { + "node": "mul_307", + "inputs": [ + "view_149", + "mul_306" + ], + "output": "mul_307", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/e1866b6254f7909c12ae9d54062b0ecf0067d708abb37c1e051ef870bd2203d7.wgsl" + }, + { + "node": "view_150", + "inputs": [ + "mul_307" + ], + "output": "view_150", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_175", + "inputs": [ + "view_150", + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight" + ], + "output": "linear_175", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_241", + "inputs": [ + "add_234", + "linear_175" + ], + "output": "add_241", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_309", + "inputs": [ + "add_241", + "p_model_model_language_model_layers_22_post_attention_layernorm_weight" + ], + "output": "mul_309", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_55", + "inputs": [ + "mul_309" + ], + "output": "type_as_55", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_176", + "inputs": [ + "type_as_55", + "p_model_model_language_model_layers_22_mlp_gate_proj_weight" + ], + "output": "linear_176", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_177", + "inputs": [ + "type_as_55", + "p_model_model_language_model_layers_22_mlp_up_proj_weight" + ], + "output": "linear_177", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_310", + "inputs": [ + "linear_176", + "linear_177" + ], + "output": "mul_310", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_178", + "inputs": [ + "mul_310", + "p_model_model_language_model_layers_22_mlp_down_proj_weight" + ], + "output": "linear_178", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_244", + "inputs": [ + "add_241", + "linear_178" + ], + "output": "add_244", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_312", + "inputs": [ + "add_244", + "p_model_model_language_model_layers_23_input_layernorm_weight" + ], + "output": "mul_312", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_56", + "inputs": [ + "mul_312" + ], + "output": "type_as_56", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_179", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_q_proj_weight" + ], + "output": "linear_179", + "workgroups": [ + 512, + 8, + 1 + ], + "kernel": "kernels/ec17c9e66b2ad1dbed2547b1df93357497b8fca1052cd2375de06b2925123a97.wgsl" + }, + { + "node": "view_151", + "inputs": [ + "linear_179" + ], + "output": "view_151", + "workgroups": [ + 4096, + 1, + 1 + ], + "kernel": "kernels/4994822b8f6f72d6a49dbf791f601000cb548364e6fd285cfbbda90b6d5b08a1.wgsl" + }, + { + "node": "slice_204", + "inputs": [ + "view_151" + ], + "output": "slice_204", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/3a76085983a5330bf07a4166ea4975700403f9d8035a8ef450f7f18b9cf47c66.wgsl" + }, + { + "node": "slice_205", + "inputs": [ + "view_151" + ], + "output": "slice_205", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/9044193f1f4724f15ef5fb41040b7fbac5f62fcaea80594737214bf9cd6be41a.wgsl" + }, + { + "node": "clone_38", + "inputs": [ + "slice_205" + ], + "output": "clone_38", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "_unsafe_view_15", + "inputs": [ + "clone_38" + ], + "output": "_unsafe_view_15", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_152", + "inputs": [ + "slice_204" + ], + "output": "view_152", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "mul_314", + "inputs": [ + "view_152", + "p_model_model_language_model_layers_23_self_attn_q_norm_weight" + ], + "output": "mul_314", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/ef364f47cced448917d1b6842c708dee101d53d7a781014f9a822214cea72bf8.wgsl" + }, + { + "node": "type_as_57", + "inputs": [ + "mul_314" + ], + "output": "type_as_57", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "transpose_92", + "inputs": [ + "type_as_57" + ], + "output": "transpose_92", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl" + }, + { + "node": "linear_180", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_k_proj_weight" + ], + "output": "linear_180", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_153", + "inputs": [ + "linear_180" + ], + "output": "view_153", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "mul_316", + "inputs": [ + "view_153", + "p_model_model_language_model_layers_23_self_attn_k_norm_weight" + ], + "output": "mul_316", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl" + }, + { + "node": "type_as_58", + "inputs": [ + "mul_316" + ], + "output": "type_as_58", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_93", + "inputs": [ + "type_as_58" + ], + "output": "transpose_93", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "linear_181", + "inputs": [ + "type_as_56", + "p_model_model_language_model_layers_23_self_attn_v_proj_weight" + ], + "output": "linear_181", + "workgroups": [ + 64, + 8, + 1 + ], + "kernel": "kernels/e625a45b19e2fcc344b9bacb77fedc85870817ec32f34118246c8cb7b01f71e9.wgsl" + }, + { + "node": "view_154", + "inputs": [ + "linear_181" + ], + "output": "view_154", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/8edd8a2bae8f26ae570c97da27c254da93d6b2df00784f505002f97830f806b3.wgsl" + }, + { + "node": "transpose_94", + "inputs": [ + "view_154" + ], + "output": "transpose_94", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/bcb78b92dbbfeb212c190e064bc2f9d8e79c201398cf38c9aa62df6fdba94469.wgsl" + }, + { + "node": "unsqueeze_42", + "inputs": [ + "mul" + ], + "output": "unsqueeze_42", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "unsqueeze_43", + "inputs": [ + "mul_1" + ], + "output": "unsqueeze_43", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/5f4403d78557e88e66d71eb5e53746cc07449a7c421b57eda4f093a09a68a99a.wgsl" + }, + { + "node": "slice_206", + "inputs": [ + "transpose_92" + ], + "output": "slice_206", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/4d8ebffbbf193b18c13a5cc17d286bf5c92c5ba53ca022af78a9151ec1e5b9c0.wgsl" + }, + { + "node": "slice_207", + "inputs": [ + "transpose_92" + ], + "output": "slice_207", + "workgroups": [ + 1536, + 1, + 1 + ], + "kernel": "kernels/4406ab1e6e4b9eeb91ace297320aa05a55cc481e02894a4a74b655b4070ade36.wgsl" + }, + { + "node": "slice_208", + "inputs": [ + "transpose_93" + ], + "output": "slice_208", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/89f98b79c18e7f4bbbd79cbd8d3e80108d0e1e4407c161d9637b6a88d3fbe06b.wgsl" + }, + { + "node": "slice_209", + "inputs": [ + "transpose_93" + ], + "output": "slice_209", + "workgroups": [ + 384, + 1, + 1 + ], + "kernel": "kernels/bd70e4fc42ac55f0f52612841bcc3f9fe7df5bbb0fc76f94e56a131a92454658.wgsl" + }, + { + "node": "mul_317", + "inputs": [ + "slice_206", + "unsqueeze_42" + ], + "output": "mul_317", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "slice_210", + "inputs": [ + "slice_206" + ], + "output": "slice_210", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/2c66dcac8fdd3caa9ff1e2441524070c21c24df9526bee44c49e765a8d4c8222.wgsl" + }, + { + "node": "slice_211", + "inputs": [ + "slice_206" + ], + "output": "slice_211", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/33e8ec04c66adb4988f562f0f9d3e92d29dfda91a56d0ed62be598c7c737f5ba.wgsl" + }, + { + "node": "neg_28", + "inputs": [ + "slice_211" + ], + "output": "neg_28", + "workgroups": [ + 256, + 1, + 1 + ], + "kernel": "kernels/3e34409407100d4858c4c109cf62f3eaf2f4c6081166b0ec8679105e6dfbe7fe.wgsl" + }, + { + "node": "cat_39", + "inputs": [ + "neg_28", + "slice_210" + ], + "output": "cat_39", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/85964f8bbe5a2e4d430930e1050ea76871f0f2453c3cd4ba020002c0562ca680.wgsl" + }, + { + "node": "mul_318", + "inputs": [ + "cat_39", + "unsqueeze_43" + ], + "output": "mul_318", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/39646bdfafd1ab0cb874474e3f1e9d79b57f10582a1804bc1d3762a492fec851.wgsl" + }, + { + "node": "add_251", + "inputs": [ + "mul_317", + "mul_318" + ], + "output": "add_251", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/d2866fd21f58839ea7d43bf83fde4243c38e4f1771034520abb020be5d819a96.wgsl" + }, + { + "node": "mul_319", + "inputs": [ + "slice_208", + "unsqueeze_42" + ], + "output": "mul_319", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "slice_212", + "inputs": [ + "slice_208" + ], + "output": "slice_212", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/7b7c42c04ea3c6695ddead641e88b82d8f130015e138fc323eec509b5b56cfa9.wgsl" + }, + { + "node": "slice_213", + "inputs": [ + "slice_208" + ], + "output": "slice_213", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/6d82b7ed99a04f03fa0b9d241188d9613fa3ce9ff425cf8ee30a7f4ce6ded13d.wgsl" + }, + { + "node": "neg_29", + "inputs": [ + "slice_213" + ], + "output": "neg_29", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/adf1e58a124e1301625024ae142dca5fb1dd50799fa94b52eaeffb82ea99852c.wgsl" + }, + { + "node": "cat_40", + "inputs": [ + "neg_29", + "slice_212" + ], + "output": "cat_40", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/82d700d77c249d637b7592f92c488497797a3961ea85b74ad2e50cccef3ef78f.wgsl" + }, + { + "node": "mul_320", + "inputs": [ + "cat_40", + "unsqueeze_43" + ], + "output": "mul_320", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/39e41393f5850cc4f0b2e8172a3c53c8c7fb874ceb4df2c6f13f9af6128ad7fc.wgsl" + }, + { + "node": "add_252", + "inputs": [ + "mul_319", + "mul_320" + ], + "output": "add_252", + "workgroups": [ + 128, + 1, + 1 + ], + "kernel": "kernels/605f51996eef0769d3b456a83f7540262d1761589b55d1fd41fb2b4dd8fa249f.wgsl" + }, + { + "node": "cat_41", + "inputs": [ + "add_251", + "slice_207" + ], + "output": "cat_41", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/8affc7c0e85127430e406be35ebb5c5354a8dd26ecc4ae9ab6ace80ce6775f46.wgsl" + }, + { + "node": "cat_42", + "inputs": [ + "add_252", + "slice_209" + ], + "output": "cat_42", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/928e4759658bc5813ad5b82855d1a8c13e144cdfe50229dfc10b0624d7490858.wgsl" + }, + { + "node": "cache_update_10", + "inputs": [ + "cat_42", + "cache_position" + ], + "output": "cache_update_10", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_46", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "cache_update_11", + "inputs": [ + "transpose_94", + "cache_position" + ], + "output": "cache_update_11", + "workgroups": [ + 512, + 1, + 1 + ], + "inPlaceOf": "states_47", + "kernel": "kernels/e369b5c120d84bfebbc35e3da096c33e55d20a607aecd5d82da5de4c95176e00.wgsl" + }, + { + "node": "unsqueeze_44", + "inputs": [ + "cache_update_10" + ], + "output": "unsqueeze_44", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_11", + "inputs": [ + "unsqueeze_44" + ], + "output": "expand_11", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_39", + "inputs": [ + "expand_11" + ], + "output": "clone_39", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_16", + "inputs": [ + "clone_39" + ], + "output": "_unsafe_view_16", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "unsqueeze_45", + "inputs": [ + "cache_update_11" + ], + "output": "unsqueeze_45", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/7fab02b2d46f9419002e2fc6f6e0e4e745ddb737a2c9e7060e45e7125c1be187.wgsl" + }, + { + "node": "expand_12", + "inputs": [ + "unsqueeze_45" + ], + "output": "expand_12", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/c295fd955666232c92869895d186ebd33a25e4a5bf14df41d5b455fbe304d007.wgsl" + }, + { + "node": "clone_40", + "inputs": [ + "expand_12" + ], + "output": "clone_40", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "_unsafe_view_17", + "inputs": [ + "clone_40" + ], + "output": "_unsafe_view_17", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/f6ccc1a43bc7cbaab21e08ce5de522f383236035c835289025961d70c49c60e8.wgsl" + }, + { + "node": "transpose_95", + "inputs": [ + "_unsafe_view_16" + ], + "output": "transpose_95", + "workgroups": [ + 65535, + 3, + 1 + ], + "kernel": "kernels/b3128f8b5ac3b671947588c52e53f26426877fd37a2e7bdfcd9819a6cbb7e3a7.wgsl" + }, + { + "node": "matmul_11", + "inputs": [ + "cat_41", + "transpose_95" + ], + "output": "matmul_11", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/84759f77f2f54fed243fc0075b3c0152a1d7f9a659dade7970962d5d41e931b4.wgsl" + }, + { + "node": "mul_321", + "inputs": [ + "matmul_11" + ], + "output": "mul_321", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/f30ef45cea0a5e5df2b57e6af796e4798fb3c745a9b0bc926c24ce3cc9dec0da.wgsl" + }, + { + "node": "add_253", + "inputs": [ + "mul_321", + "attention_mask" + ], + "output": "add_253", + "workgroups": [ + 32768, + 1, + 1 + ], + "kernel": "kernels/8e0a5082868763863aafd2f06c712052ff8e27c61b6a010bfe35849c65245c5c.wgsl" + }, + { + "node": "softmax_5", + "inputs": [ + "add_253" + ], + "output": "softmax_5", + "workgroups": [ + 512, + 1, + 1 + ], + "kernel": "kernels/c2c557bad313dd62b6319363dd3b6b7224c3b64768c5303080a9743abb736117.wgsl" + }, + { + "node": "matmul_12", + "inputs": [ + "softmax_5", + "_unsafe_view_17" + ], + "output": "matmul_12", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/429a69a1118b6732c4f0cd10f20d101828b2d0da3ac4b58cb6379ae985432221.wgsl" + }, + { + "node": "transpose_96", + "inputs": [ + "matmul_12" + ], + "output": "transpose_96", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/4f2c0d08150d4b97d90c244db2d41baca81484c2630dbbd6d586f2d8a4b07b8b.wgsl" + }, + { + "node": "clone_41", + "inputs": [ + "transpose_96" + ], + "output": "clone_41", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "view_155", + "inputs": [ + "clone_41" + ], + "output": "view_155", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "sigmoid_23", + "inputs": [ + "_unsafe_view_15" + ], + "output": "sigmoid_23", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/50535e4c99d9fb4a272d8260a1415f6b38a7ad1025da64e145f230df697d9b73.wgsl" + }, + { + "node": "mul_322", + "inputs": [ + "view_155", + "sigmoid_23" + ], + "output": "mul_322", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/a9f6bc361f1ea31f79f0ef6164872eeb04896a45338871a2d779789b47b1920b.wgsl" + }, + { + "node": "linear_182", + "inputs": [ + "mul_322", + "p_model_model_language_model_layers_23_self_attn_o_proj_weight" + ], + "output": "linear_182", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/e8f318242666dd54f6bcb99ee9bea81797d22fb0c3530388b72aee83bccdc96a.wgsl" + }, + { + "node": "add_254", + "inputs": [ + "add_244", + "linear_182" + ], + "output": "add_254", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_324", + "inputs": [ + "add_254", + "p_model_model_language_model_layers_23_post_attention_layernorm_weight" + ], + "output": "mul_324", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_59", + "inputs": [ + "mul_324" + ], + "output": "type_as_59", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_183", + "inputs": [ + "type_as_59", + "p_model_model_language_model_layers_23_mlp_gate_proj_weight" + ], + "output": "linear_183", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "linear_184", + "inputs": [ + "type_as_59", + "p_model_model_language_model_layers_23_mlp_up_proj_weight" + ], + "output": "linear_184", + "workgroups": [ + 768, + 8, + 1 + ], + "kernel": "kernels/810f4f0382885bc94f69164288e74f8a736b3644370a205c9c12d330192b00c9.wgsl" + }, + { + "node": "mul_325", + "inputs": [ + "linear_183", + "linear_184" + ], + "output": "mul_325", + "workgroups": [ + 6144, + 1, + 1 + ], + "kernel": "kernels/2b02ece9784fc350cef18e08c962031f74dbc27c7d1cad3a13dda1cebb84b403.wgsl" + }, + { + "node": "linear_185", + "inputs": [ + "mul_325", + "p_model_model_language_model_layers_23_mlp_down_proj_weight" + ], + "output": "linear_185", + "workgroups": [ + 256, + 8, + 1 + ], + "kernel": "kernels/437da2f2f6d8aa65301222936ae6a18a2357c28cd479592e8141f88a97972da0.wgsl" + }, + { + "node": "add_257", + "inputs": [ + "add_254", + "linear_185" + ], + "output": "add_257", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/c9dce107dfa3160c552e0381c1859565c3e7e014e76b9a5c9845a7aa9979866a.wgsl" + }, + { + "node": "mul_327", + "inputs": [ + "add_257", + "p_model_model_language_model_norm_weight" + ], + "output": "mul_327", + "workgroups": [ + 64, + 1, + 1 + ], + "kernel": "kernels/35b866864f2f36fad2f64440227cd6088083c96b0ef50192ce71ef159e1d1b11.wgsl" + }, + { + "node": "type_as_60", + "inputs": [ + "mul_327" + ], + "output": "type_as_60", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "alias", + "inputs": [ + "type_as_60" + ], + "output": "alias", + "workgroups": [ + 2048, + 1, + 1 + ], + "kernel": "kernels/f23ccedb2e02f7ccd40a4171c0a1ced4c4e7eec4dc1ed9604f668f691baa68e2.wgsl" + }, + { + "node": "linear_186__part_0", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_0_32768" + ], + "output": "linear_186__part_0", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_1", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768" + ], + "output": "linear_186__part_1", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_2", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768" + ], + "output": "linear_186__part_2", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_3", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768" + ], + "output": "linear_186__part_3", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_4", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768" + ], + "output": "linear_186__part_4", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_5", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768" + ], + "output": "linear_186__part_5", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_6", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768" + ], + "output": "linear_186__part_6", + "workgroups": [ + 4096, + 8, + 1 + ], + "kernel": "kernels/97f95797eb6ec79925daae2004583ba556d6376a470860609d4c61bc83e15510.wgsl" + }, + { + "node": "linear_186__part_7", + "inputs": [ + "alias", + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944" + ], + "output": "linear_186__part_7", + "workgroups": [ + 2368, + 8, + 1 + ], + "kernel": "kernels/5244c41c17f08956963dde4c3784e8e122ba0e3c0d76794c8b3673252f672f27.wgsl" + }, + { + "node": "linear_186__cat_0_0", + "inputs": [ + "linear_186__part_0", + "linear_186__part_1", + "linear_186__part_2", + "linear_186__part_3", + "linear_186__part_4", + "linear_186__part_5", + "linear_186__part_6" + ], + "output": "linear_186__cat_0_0", + "workgroups": [ + 65535, + 4, + 1 + ], + "kernel": "kernels/3b2b13d75a6ce00e35c674883bbf1969555c8fc9e088e7d2003a5ea57b4552ff.wgsl" + }, + { + "node": "linear_186__cat_0_7", + "inputs": [ + "linear_186__part_7" + ], + "output": "linear_186__cat_0_7", + "workgroups": [ + 18944, + 1, + 1 + ], + "kernel": "kernels/c804a18a7bed0d1c647838cab84658e1a40005fc2100decef96e2ed66e1f8c0b.wgsl" + }, + { + "node": "linear_186", + "inputs": [ + "linear_186__cat_0_0", + "linear_186__cat_0_7" + ], + "output": "linear_186", + "workgroups": [ + 65535, + 4, + 1 + ], + "kernel": "kernels/48ec6f5173dcab06386f158b26dfbecfb5022f620fa9588a9cb947664b01037e.wgsl" + } + ], + "memory": { + "slots": [ + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 64, + 64, + 25165824, + 8388608, + 65536, + 65536, + 98304, + 512, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 16777216, + 1024, + 2097152, + 1024, + 2097152, + 8388608, + 8192, + 25165824, + 25165824, + 25165824, + 8192, + 128, + 256, + 1024, + 1048576, + 524288, + 256, + 256, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 98304, + 1048576, + 98304, + 1048576, + 98304, + 1048576, + 8388608, + 8388608, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 134217728, + 77594624, + 524288, + 524288, + 524288, + 524288, + 524288, + 524288, + 524288, + 524288, + 524288, + 1572864, + 1572864, + 1671168, + 1744896, + 98304, + 65536, + 65536, + 131072, + 8388608, + 33554432, + 33554432, + 33554432, + 8388608, + 8388608, + 8388608, + 4849664, + 58720256, + 63569920 + ], + "assignment": { + "p_model_model_language_model_layers_0_input_layernorm_weight": 0, + "p_model_model_language_model_layers_0_linear_attn_a_log": 1, + "p_model_model_language_model_layers_0_linear_attn_dt_bias": 2, + "p_model_model_language_model_layers_0_linear_attn_in_proj_qkv_weight": 3, + "p_model_model_language_model_layers_0_linear_attn_in_proj_z_weight": 4, + "p_model_model_language_model_layers_0_linear_attn_in_proj_b_weight": 5, + "p_model_model_language_model_layers_0_linear_attn_in_proj_a_weight": 6, + "p_model_model_language_model_layers_0_linear_attn_conv1d_weight": 7, + "p_model_model_language_model_layers_0_linear_attn_norm_weight": 8, + "p_model_model_language_model_layers_0_linear_attn_out_proj_weight": 9, + "p_model_model_language_model_layers_0_post_attention_layernorm_weight": 10, + "p_model_model_language_model_layers_0_mlp_gate_proj_weight": 11, + "p_model_model_language_model_layers_0_mlp_up_proj_weight": 12, + "p_model_model_language_model_layers_0_mlp_down_proj_weight": 13, + "p_model_model_language_model_layers_1_input_layernorm_weight": 14, + "p_model_model_language_model_layers_1_linear_attn_a_log": 15, + "p_model_model_language_model_layers_1_linear_attn_dt_bias": 16, + "p_model_model_language_model_layers_1_linear_attn_in_proj_qkv_weight": 17, + "p_model_model_language_model_layers_1_linear_attn_in_proj_z_weight": 18, + "p_model_model_language_model_layers_1_linear_attn_in_proj_b_weight": 19, + "p_model_model_language_model_layers_1_linear_attn_in_proj_a_weight": 20, + "p_model_model_language_model_layers_1_linear_attn_conv1d_weight": 21, + "p_model_model_language_model_layers_1_linear_attn_norm_weight": 22, + "p_model_model_language_model_layers_1_linear_attn_out_proj_weight": 23, + "p_model_model_language_model_layers_1_post_attention_layernorm_weight": 24, + "p_model_model_language_model_layers_1_mlp_gate_proj_weight": 25, + "p_model_model_language_model_layers_1_mlp_up_proj_weight": 26, + "p_model_model_language_model_layers_1_mlp_down_proj_weight": 27, + "p_model_model_language_model_layers_2_input_layernorm_weight": 28, + "p_model_model_language_model_layers_2_linear_attn_a_log": 29, + "p_model_model_language_model_layers_2_linear_attn_dt_bias": 30, + "p_model_model_language_model_layers_2_linear_attn_in_proj_qkv_weight": 31, + "p_model_model_language_model_layers_2_linear_attn_in_proj_z_weight": 32, + "p_model_model_language_model_layers_2_linear_attn_in_proj_b_weight": 33, + "p_model_model_language_model_layers_2_linear_attn_in_proj_a_weight": 34, + "p_model_model_language_model_layers_2_linear_attn_conv1d_weight": 35, + "p_model_model_language_model_layers_2_linear_attn_norm_weight": 36, + "p_model_model_language_model_layers_2_linear_attn_out_proj_weight": 37, + "p_model_model_language_model_layers_2_post_attention_layernorm_weight": 38, + "p_model_model_language_model_layers_2_mlp_gate_proj_weight": 39, + "p_model_model_language_model_layers_2_mlp_up_proj_weight": 40, + "p_model_model_language_model_layers_2_mlp_down_proj_weight": 41, + "p_model_model_language_model_layers_3_input_layernorm_weight": 42, + "p_model_model_language_model_layers_3_self_attn_q_proj_weight": 43, + "p_model_model_language_model_layers_3_self_attn_q_norm_weight": 44, + "p_model_model_language_model_layers_3_self_attn_k_proj_weight": 45, + "p_model_model_language_model_layers_3_self_attn_k_norm_weight": 46, + "p_model_model_language_model_layers_3_self_attn_v_proj_weight": 47, + "p_model_model_language_model_layers_3_self_attn_o_proj_weight": 48, + "p_model_model_language_model_layers_3_post_attention_layernorm_weight": 49, + "p_model_model_language_model_layers_3_mlp_gate_proj_weight": 50, + "p_model_model_language_model_layers_3_mlp_up_proj_weight": 51, + "p_model_model_language_model_layers_3_mlp_down_proj_weight": 52, + "p_model_model_language_model_layers_4_input_layernorm_weight": 53, + "p_model_model_language_model_layers_4_linear_attn_a_log": 54, + "p_model_model_language_model_layers_4_linear_attn_dt_bias": 55, + "p_model_model_language_model_layers_4_linear_attn_in_proj_qkv_weight": 56, + "p_model_model_language_model_layers_4_linear_attn_in_proj_z_weight": 57, + "p_model_model_language_model_layers_4_linear_attn_in_proj_b_weight": 58, + "p_model_model_language_model_layers_4_linear_attn_in_proj_a_weight": 59, + "p_model_model_language_model_layers_4_linear_attn_conv1d_weight": 60, + "p_model_model_language_model_layers_4_linear_attn_norm_weight": 61, + "p_model_model_language_model_layers_4_linear_attn_out_proj_weight": 62, + "p_model_model_language_model_layers_4_post_attention_layernorm_weight": 63, + "p_model_model_language_model_layers_4_mlp_gate_proj_weight": 64, + "p_model_model_language_model_layers_4_mlp_up_proj_weight": 65, + "p_model_model_language_model_layers_4_mlp_down_proj_weight": 66, + "p_model_model_language_model_layers_5_input_layernorm_weight": 67, + "p_model_model_language_model_layers_5_linear_attn_a_log": 68, + "p_model_model_language_model_layers_5_linear_attn_dt_bias": 69, + "p_model_model_language_model_layers_5_linear_attn_in_proj_qkv_weight": 70, + "p_model_model_language_model_layers_5_linear_attn_in_proj_z_weight": 71, + "p_model_model_language_model_layers_5_linear_attn_in_proj_b_weight": 72, + "p_model_model_language_model_layers_5_linear_attn_in_proj_a_weight": 73, + "p_model_model_language_model_layers_5_linear_attn_conv1d_weight": 74, + "p_model_model_language_model_layers_5_linear_attn_norm_weight": 75, + "p_model_model_language_model_layers_5_linear_attn_out_proj_weight": 76, + "p_model_model_language_model_layers_5_post_attention_layernorm_weight": 77, + "p_model_model_language_model_layers_5_mlp_gate_proj_weight": 78, + "p_model_model_language_model_layers_5_mlp_up_proj_weight": 79, + "p_model_model_language_model_layers_5_mlp_down_proj_weight": 80, + "p_model_model_language_model_layers_6_input_layernorm_weight": 81, + "p_model_model_language_model_layers_6_linear_attn_a_log": 82, + "p_model_model_language_model_layers_6_linear_attn_dt_bias": 83, + "p_model_model_language_model_layers_6_linear_attn_in_proj_qkv_weight": 84, + "p_model_model_language_model_layers_6_linear_attn_in_proj_z_weight": 85, + "p_model_model_language_model_layers_6_linear_attn_in_proj_b_weight": 86, + "p_model_model_language_model_layers_6_linear_attn_in_proj_a_weight": 87, + "p_model_model_language_model_layers_6_linear_attn_conv1d_weight": 88, + "p_model_model_language_model_layers_6_linear_attn_norm_weight": 89, + "p_model_model_language_model_layers_6_linear_attn_out_proj_weight": 90, + "p_model_model_language_model_layers_6_post_attention_layernorm_weight": 91, + "p_model_model_language_model_layers_6_mlp_gate_proj_weight": 92, + "p_model_model_language_model_layers_6_mlp_up_proj_weight": 93, + "p_model_model_language_model_layers_6_mlp_down_proj_weight": 94, + "p_model_model_language_model_layers_7_input_layernorm_weight": 95, + "p_model_model_language_model_layers_7_self_attn_q_proj_weight": 96, + "p_model_model_language_model_layers_7_self_attn_q_norm_weight": 97, + "p_model_model_language_model_layers_7_self_attn_k_proj_weight": 98, + "p_model_model_language_model_layers_7_self_attn_k_norm_weight": 99, + "p_model_model_language_model_layers_7_self_attn_v_proj_weight": 100, + "p_model_model_language_model_layers_7_self_attn_o_proj_weight": 101, + "p_model_model_language_model_layers_7_post_attention_layernorm_weight": 102, + "p_model_model_language_model_layers_7_mlp_gate_proj_weight": 103, + "p_model_model_language_model_layers_7_mlp_up_proj_weight": 104, + "p_model_model_language_model_layers_7_mlp_down_proj_weight": 105, + "p_model_model_language_model_layers_8_input_layernorm_weight": 106, + "p_model_model_language_model_layers_8_linear_attn_a_log": 107, + "p_model_model_language_model_layers_8_linear_attn_dt_bias": 108, + "p_model_model_language_model_layers_8_linear_attn_in_proj_qkv_weight": 109, + "p_model_model_language_model_layers_8_linear_attn_in_proj_z_weight": 110, + "p_model_model_language_model_layers_8_linear_attn_in_proj_b_weight": 111, + "p_model_model_language_model_layers_8_linear_attn_in_proj_a_weight": 112, + "p_model_model_language_model_layers_8_linear_attn_conv1d_weight": 113, + "p_model_model_language_model_layers_8_linear_attn_norm_weight": 114, + "p_model_model_language_model_layers_8_linear_attn_out_proj_weight": 115, + "p_model_model_language_model_layers_8_post_attention_layernorm_weight": 116, + "p_model_model_language_model_layers_8_mlp_gate_proj_weight": 117, + "p_model_model_language_model_layers_8_mlp_up_proj_weight": 118, + "p_model_model_language_model_layers_8_mlp_down_proj_weight": 119, + "p_model_model_language_model_layers_9_input_layernorm_weight": 120, + "p_model_model_language_model_layers_9_linear_attn_a_log": 121, + "p_model_model_language_model_layers_9_linear_attn_dt_bias": 122, + "p_model_model_language_model_layers_9_linear_attn_in_proj_qkv_weight": 123, + "p_model_model_language_model_layers_9_linear_attn_in_proj_z_weight": 124, + "p_model_model_language_model_layers_9_linear_attn_in_proj_b_weight": 125, + "p_model_model_language_model_layers_9_linear_attn_in_proj_a_weight": 126, + "p_model_model_language_model_layers_9_linear_attn_conv1d_weight": 127, + "p_model_model_language_model_layers_9_linear_attn_norm_weight": 128, + "p_model_model_language_model_layers_9_linear_attn_out_proj_weight": 129, + "p_model_model_language_model_layers_9_post_attention_layernorm_weight": 130, + "p_model_model_language_model_layers_9_mlp_gate_proj_weight": 131, + "p_model_model_language_model_layers_9_mlp_up_proj_weight": 132, + "p_model_model_language_model_layers_9_mlp_down_proj_weight": 133, + "p_model_model_language_model_layers_10_input_layernorm_weight": 134, + "p_model_model_language_model_layers_10_linear_attn_a_log": 135, + "p_model_model_language_model_layers_10_linear_attn_dt_bias": 136, + "p_model_model_language_model_layers_10_linear_attn_in_proj_qkv_weight": 137, + "p_model_model_language_model_layers_10_linear_attn_in_proj_z_weight": 138, + "p_model_model_language_model_layers_10_linear_attn_in_proj_b_weight": 139, + "p_model_model_language_model_layers_10_linear_attn_in_proj_a_weight": 140, + "p_model_model_language_model_layers_10_linear_attn_conv1d_weight": 141, + "p_model_model_language_model_layers_10_linear_attn_norm_weight": 142, + "p_model_model_language_model_layers_10_linear_attn_out_proj_weight": 143, + "p_model_model_language_model_layers_10_post_attention_layernorm_weight": 144, + "p_model_model_language_model_layers_10_mlp_gate_proj_weight": 145, + "p_model_model_language_model_layers_10_mlp_up_proj_weight": 146, + "p_model_model_language_model_layers_10_mlp_down_proj_weight": 147, + "p_model_model_language_model_layers_11_input_layernorm_weight": 148, + "p_model_model_language_model_layers_11_self_attn_q_proj_weight": 149, + "p_model_model_language_model_layers_11_self_attn_q_norm_weight": 150, + "p_model_model_language_model_layers_11_self_attn_k_proj_weight": 151, + "p_model_model_language_model_layers_11_self_attn_k_norm_weight": 152, + "p_model_model_language_model_layers_11_self_attn_v_proj_weight": 153, + "p_model_model_language_model_layers_11_self_attn_o_proj_weight": 154, + "p_model_model_language_model_layers_11_post_attention_layernorm_weight": 155, + "p_model_model_language_model_layers_11_mlp_gate_proj_weight": 156, + "p_model_model_language_model_layers_11_mlp_up_proj_weight": 157, + "p_model_model_language_model_layers_11_mlp_down_proj_weight": 158, + "p_model_model_language_model_layers_12_input_layernorm_weight": 159, + "p_model_model_language_model_layers_12_linear_attn_a_log": 160, + "p_model_model_language_model_layers_12_linear_attn_dt_bias": 161, + "p_model_model_language_model_layers_12_linear_attn_in_proj_qkv_weight": 162, + "p_model_model_language_model_layers_12_linear_attn_in_proj_z_weight": 163, + "p_model_model_language_model_layers_12_linear_attn_in_proj_b_weight": 164, + "p_model_model_language_model_layers_12_linear_attn_in_proj_a_weight": 165, + "p_model_model_language_model_layers_12_linear_attn_conv1d_weight": 166, + "p_model_model_language_model_layers_12_linear_attn_norm_weight": 167, + "p_model_model_language_model_layers_12_linear_attn_out_proj_weight": 168, + "p_model_model_language_model_layers_12_post_attention_layernorm_weight": 169, + "p_model_model_language_model_layers_12_mlp_gate_proj_weight": 170, + "p_model_model_language_model_layers_12_mlp_up_proj_weight": 171, + "p_model_model_language_model_layers_12_mlp_down_proj_weight": 172, + "p_model_model_language_model_layers_13_input_layernorm_weight": 173, + "p_model_model_language_model_layers_13_linear_attn_a_log": 174, + "p_model_model_language_model_layers_13_linear_attn_dt_bias": 175, + "p_model_model_language_model_layers_13_linear_attn_in_proj_qkv_weight": 176, + "p_model_model_language_model_layers_13_linear_attn_in_proj_z_weight": 177, + "p_model_model_language_model_layers_13_linear_attn_in_proj_b_weight": 178, + "p_model_model_language_model_layers_13_linear_attn_in_proj_a_weight": 179, + "p_model_model_language_model_layers_13_linear_attn_conv1d_weight": 180, + "p_model_model_language_model_layers_13_linear_attn_norm_weight": 181, + "p_model_model_language_model_layers_13_linear_attn_out_proj_weight": 182, + "p_model_model_language_model_layers_13_post_attention_layernorm_weight": 183, + "p_model_model_language_model_layers_13_mlp_gate_proj_weight": 184, + "p_model_model_language_model_layers_13_mlp_up_proj_weight": 185, + "p_model_model_language_model_layers_13_mlp_down_proj_weight": 186, + "p_model_model_language_model_layers_14_input_layernorm_weight": 187, + "p_model_model_language_model_layers_14_linear_attn_a_log": 188, + "p_model_model_language_model_layers_14_linear_attn_dt_bias": 189, + "p_model_model_language_model_layers_14_linear_attn_in_proj_qkv_weight": 190, + "p_model_model_language_model_layers_14_linear_attn_in_proj_z_weight": 191, + "p_model_model_language_model_layers_14_linear_attn_in_proj_b_weight": 192, + "p_model_model_language_model_layers_14_linear_attn_in_proj_a_weight": 193, + "p_model_model_language_model_layers_14_linear_attn_conv1d_weight": 194, + "p_model_model_language_model_layers_14_linear_attn_norm_weight": 195, + "p_model_model_language_model_layers_14_linear_attn_out_proj_weight": 196, + "p_model_model_language_model_layers_14_post_attention_layernorm_weight": 197, + "p_model_model_language_model_layers_14_mlp_gate_proj_weight": 198, + "p_model_model_language_model_layers_14_mlp_up_proj_weight": 199, + "p_model_model_language_model_layers_14_mlp_down_proj_weight": 200, + "p_model_model_language_model_layers_15_input_layernorm_weight": 201, + "p_model_model_language_model_layers_15_self_attn_q_proj_weight": 202, + "p_model_model_language_model_layers_15_self_attn_q_norm_weight": 203, + "p_model_model_language_model_layers_15_self_attn_k_proj_weight": 204, + "p_model_model_language_model_layers_15_self_attn_k_norm_weight": 205, + "p_model_model_language_model_layers_15_self_attn_v_proj_weight": 206, + "p_model_model_language_model_layers_15_self_attn_o_proj_weight": 207, + "p_model_model_language_model_layers_15_post_attention_layernorm_weight": 208, + "p_model_model_language_model_layers_15_mlp_gate_proj_weight": 209, + "p_model_model_language_model_layers_15_mlp_up_proj_weight": 210, + "p_model_model_language_model_layers_15_mlp_down_proj_weight": 211, + "p_model_model_language_model_layers_16_input_layernorm_weight": 212, + "p_model_model_language_model_layers_16_linear_attn_a_log": 213, + "p_model_model_language_model_layers_16_linear_attn_dt_bias": 214, + "p_model_model_language_model_layers_16_linear_attn_in_proj_qkv_weight": 215, + "p_model_model_language_model_layers_16_linear_attn_in_proj_z_weight": 216, + "p_model_model_language_model_layers_16_linear_attn_in_proj_b_weight": 217, + "p_model_model_language_model_layers_16_linear_attn_in_proj_a_weight": 218, + "p_model_model_language_model_layers_16_linear_attn_conv1d_weight": 219, + "p_model_model_language_model_layers_16_linear_attn_norm_weight": 220, + "p_model_model_language_model_layers_16_linear_attn_out_proj_weight": 221, + "p_model_model_language_model_layers_16_post_attention_layernorm_weight": 222, + "p_model_model_language_model_layers_16_mlp_gate_proj_weight": 223, + "p_model_model_language_model_layers_16_mlp_up_proj_weight": 224, + "p_model_model_language_model_layers_16_mlp_down_proj_weight": 225, + "p_model_model_language_model_layers_17_input_layernorm_weight": 226, + "p_model_model_language_model_layers_17_linear_attn_a_log": 227, + "p_model_model_language_model_layers_17_linear_attn_dt_bias": 228, + "p_model_model_language_model_layers_17_linear_attn_in_proj_qkv_weight": 229, + "p_model_model_language_model_layers_17_linear_attn_in_proj_z_weight": 230, + "p_model_model_language_model_layers_17_linear_attn_in_proj_b_weight": 231, + "p_model_model_language_model_layers_17_linear_attn_in_proj_a_weight": 232, + "p_model_model_language_model_layers_17_linear_attn_conv1d_weight": 233, + "p_model_model_language_model_layers_17_linear_attn_norm_weight": 234, + "p_model_model_language_model_layers_17_linear_attn_out_proj_weight": 235, + "p_model_model_language_model_layers_17_post_attention_layernorm_weight": 236, + "p_model_model_language_model_layers_17_mlp_gate_proj_weight": 237, + "p_model_model_language_model_layers_17_mlp_up_proj_weight": 238, + "p_model_model_language_model_layers_17_mlp_down_proj_weight": 239, + "p_model_model_language_model_layers_18_input_layernorm_weight": 240, + "p_model_model_language_model_layers_18_linear_attn_a_log": 241, + "p_model_model_language_model_layers_18_linear_attn_dt_bias": 242, + "p_model_model_language_model_layers_18_linear_attn_in_proj_qkv_weight": 243, + "p_model_model_language_model_layers_18_linear_attn_in_proj_z_weight": 244, + "p_model_model_language_model_layers_18_linear_attn_in_proj_b_weight": 245, + "p_model_model_language_model_layers_18_linear_attn_in_proj_a_weight": 246, + "p_model_model_language_model_layers_18_linear_attn_conv1d_weight": 247, + "p_model_model_language_model_layers_18_linear_attn_norm_weight": 248, + "p_model_model_language_model_layers_18_linear_attn_out_proj_weight": 249, + "p_model_model_language_model_layers_18_post_attention_layernorm_weight": 250, + "p_model_model_language_model_layers_18_mlp_gate_proj_weight": 251, + "p_model_model_language_model_layers_18_mlp_up_proj_weight": 252, + "p_model_model_language_model_layers_18_mlp_down_proj_weight": 253, + "p_model_model_language_model_layers_19_input_layernorm_weight": 254, + "p_model_model_language_model_layers_19_self_attn_q_proj_weight": 255, + "p_model_model_language_model_layers_19_self_attn_q_norm_weight": 256, + "p_model_model_language_model_layers_19_self_attn_k_proj_weight": 257, + "p_model_model_language_model_layers_19_self_attn_k_norm_weight": 258, + "p_model_model_language_model_layers_19_self_attn_v_proj_weight": 259, + "p_model_model_language_model_layers_19_self_attn_o_proj_weight": 260, + "p_model_model_language_model_layers_19_post_attention_layernorm_weight": 261, + "p_model_model_language_model_layers_19_mlp_gate_proj_weight": 262, + "p_model_model_language_model_layers_19_mlp_up_proj_weight": 263, + "p_model_model_language_model_layers_19_mlp_down_proj_weight": 264, + "p_model_model_language_model_layers_20_input_layernorm_weight": 265, + "p_model_model_language_model_layers_20_linear_attn_a_log": 266, + "p_model_model_language_model_layers_20_linear_attn_dt_bias": 267, + "p_model_model_language_model_layers_20_linear_attn_in_proj_qkv_weight": 268, + "p_model_model_language_model_layers_20_linear_attn_in_proj_z_weight": 269, + "p_model_model_language_model_layers_20_linear_attn_in_proj_b_weight": 270, + "p_model_model_language_model_layers_20_linear_attn_in_proj_a_weight": 271, + "p_model_model_language_model_layers_20_linear_attn_conv1d_weight": 272, + "p_model_model_language_model_layers_20_linear_attn_norm_weight": 273, + "p_model_model_language_model_layers_20_linear_attn_out_proj_weight": 274, + "p_model_model_language_model_layers_20_post_attention_layernorm_weight": 275, + "p_model_model_language_model_layers_20_mlp_gate_proj_weight": 276, + "p_model_model_language_model_layers_20_mlp_up_proj_weight": 277, + "p_model_model_language_model_layers_20_mlp_down_proj_weight": 278, + "p_model_model_language_model_layers_21_input_layernorm_weight": 279, + "p_model_model_language_model_layers_21_linear_attn_a_log": 280, + "p_model_model_language_model_layers_21_linear_attn_dt_bias": 281, + "p_model_model_language_model_layers_21_linear_attn_in_proj_qkv_weight": 282, + "p_model_model_language_model_layers_21_linear_attn_in_proj_z_weight": 283, + "p_model_model_language_model_layers_21_linear_attn_in_proj_b_weight": 284, + "p_model_model_language_model_layers_21_linear_attn_in_proj_a_weight": 285, + "p_model_model_language_model_layers_21_linear_attn_conv1d_weight": 286, + "p_model_model_language_model_layers_21_linear_attn_norm_weight": 287, + "p_model_model_language_model_layers_21_linear_attn_out_proj_weight": 288, + "p_model_model_language_model_layers_21_post_attention_layernorm_weight": 289, + "p_model_model_language_model_layers_21_mlp_gate_proj_weight": 290, + "p_model_model_language_model_layers_21_mlp_up_proj_weight": 291, + "p_model_model_language_model_layers_21_mlp_down_proj_weight": 292, + "p_model_model_language_model_layers_22_input_layernorm_weight": 293, + "p_model_model_language_model_layers_22_linear_attn_a_log": 294, + "p_model_model_language_model_layers_22_linear_attn_dt_bias": 295, + "p_model_model_language_model_layers_22_linear_attn_in_proj_qkv_weight": 296, + "p_model_model_language_model_layers_22_linear_attn_in_proj_z_weight": 297, + "p_model_model_language_model_layers_22_linear_attn_in_proj_b_weight": 298, + "p_model_model_language_model_layers_22_linear_attn_in_proj_a_weight": 299, + "p_model_model_language_model_layers_22_linear_attn_conv1d_weight": 300, + "p_model_model_language_model_layers_22_linear_attn_norm_weight": 301, + "p_model_model_language_model_layers_22_linear_attn_out_proj_weight": 302, + "p_model_model_language_model_layers_22_post_attention_layernorm_weight": 303, + "p_model_model_language_model_layers_22_mlp_gate_proj_weight": 304, + "p_model_model_language_model_layers_22_mlp_up_proj_weight": 305, + "p_model_model_language_model_layers_22_mlp_down_proj_weight": 306, + "p_model_model_language_model_layers_23_input_layernorm_weight": 307, + "p_model_model_language_model_layers_23_self_attn_q_proj_weight": 308, + "p_model_model_language_model_layers_23_self_attn_q_norm_weight": 309, + "p_model_model_language_model_layers_23_self_attn_k_proj_weight": 310, + "p_model_model_language_model_layers_23_self_attn_k_norm_weight": 311, + "p_model_model_language_model_layers_23_self_attn_v_proj_weight": 312, + "p_model_model_language_model_layers_23_self_attn_o_proj_weight": 313, + "p_model_model_language_model_layers_23_post_attention_layernorm_weight": 314, + "p_model_model_language_model_layers_23_mlp_gate_proj_weight": 315, + "p_model_model_language_model_layers_23_mlp_up_proj_weight": 316, + "p_model_model_language_model_layers_23_mlp_down_proj_weight": 317, + "p_model_model_language_model_norm_weight": 318, + "b_model_model_language_model_rotary_emb_inv_freq": 319, + "input_ids": 320, + "position_ids": 321, + "attention_mask": 322, + "image_embedding": 323, + "is_image": 324, + "cache_position": 325, + "states_0": 326, + "states_1": 327, + "states_2": 328, + "states_3": 329, + "states_4": 330, + "states_5": 331, + "states_6": 332, + "states_7": 333, + "states_8": 334, + "states_9": 335, + "states_10": 336, + "states_11": 337, + "states_12": 338, + "states_13": 339, + "states_14": 340, + "states_15": 341, + "states_16": 342, + "states_17": 343, + "states_18": 344, + "states_19": 345, + "states_20": 346, + "states_21": 347, + "states_22": 348, + "states_23": 349, + "states_24": 350, + "states_25": 351, + "states_26": 352, + "states_27": 353, + "states_28": 354, + "states_29": 355, + "states_30": 356, + "states_31": 357, + "states_32": 358, + "states_33": 359, + "states_34": 360, + "states_35": 361, + "states_36": 362, + "states_37": 363, + "states_38": 364, + "states_39": 365, + "states_40": 366, + "states_41": 367, + "states_42": 368, + "states_43": 369, + "states_44": 370, + "states_45": 371, + "states_46": 372, + "states_47": 373, + "p_model_model_language_model_embed_tokens_weight__rows_0_32768": 374, + "p_model_model_language_model_embed_tokens_weight__rows_32768_32768": 375, + "p_model_model_language_model_embed_tokens_weight__rows_65536_32768": 376, + "p_model_model_language_model_embed_tokens_weight__rows_98304_32768": 377, + "p_model_model_language_model_embed_tokens_weight__rows_131072_32768": 378, + "p_model_model_language_model_embed_tokens_weight__rows_163840_32768": 379, + "p_model_model_language_model_embed_tokens_weight__rows_196608_32768": 380, + "p_model_model_language_model_embed_tokens_weight__rows_229376_18944": 381, + "embedding__part_0": 382, + "embedding__part_1": 383, + "embedding__part_2": 384, + "embedding__part_3": 385, + "embedding__part_4": 386, + "embedding__part_5": 387, + "embedding__part_6": 388, + "embedding__part_7": 389, + "embedding__sum_0": 390, + "embedding__sum_1": 382, + "embedding__sum_2": 383, + "embedding__sum_3": 390, + "embedding__sum_4": 384, + "embedding__sum_5": 382, + "embedding": 385, + "where": 383, + "slice_1": 386, + "unsqueeze": 390, + "unsqueeze_1": 387, + "unsqueeze_2": 384, + "expand": 388, + "unsqueeze_3": 382, + "_to_copy": 389, + "matmul": 385, + "transpose": 390, + "select": 387, + "select_1": 384, + "slice_2": 386, + "slice_3": 382, + "copy": 388, + "transpose_1": 389, + "select_2": 390, + "slice_scatter": 384, + "select_scatter": 387, + "transpose_2": 386, + "transpose_7": 385, + "select_7": 388, + "slice_7": 390, + "transpose_8": 384, + "select_8": 389, + "slice_8": 387, + "copy_1": 385, + "transpose_9": 388, + "select_9": 384, + "slice_scatter_1": 389, + "select_scatter_1": 387, + "transpose_10": 386, + "transpose_12": 385, + "select_11": 384, + "cat": 389, + "cos": 388, + "mul": 387, + "sin": 386, + "mul_1": 385, + "mul_3": 384, + "type_as": 388, + "linear": 391, + "transpose_13": 392, + "linear_1": 389, + "view": 386, + "linear_2": 384, + "linear_3": 389, + "cat_1": 393, + "slice_10": 326, + "squeeze": 388, + "unsqueeze_4": 391, + "conv1d": 394, + "slice_11": 393, + "silu": 394, + "slice_12": 392, + "transpose_14": 391, + "slice_13": 388, + "slice_14": 392, + "slice_15": 393, + "view_1": 391, + "view_2": 388, + "view_3": 392, + "sigmoid": 393, + "exp": 384, + "neg": 394, + "add_2": 384, + "softplus": 389, + "mul_4": 384, + "mul_5": 389, + "sum_1": 394, + "add_3": 389, + "rsqrt_1": 394, + "mul_6": 389, + "mul_7": 391, + "sum_2": 394, + "add_4": 391, + "rsqrt_2": 394, + "mul_8": 391, + "normalized_gated_delta_rule": 394, + "slice_16": 327, + "slice_17": 388, + "transpose_15": 389, + "clone": 384, + "view_4": 388, + "view_5": 389, + "mul_10": 384, + "mul_11": 386, + "view_6": 388, + "linear_4": 389, + "add_6": 384, + "mul_13": 386, + "type_as_1": 388, + "linear_5": 391, + "linear_6": 392, + "mul_14": 393, + "linear_7": 383, + "add_9": 389, + "mul_16": 386, + "type_as_2": 388, + "linear_8": 391, + "transpose_16": 392, + "linear_9": 384, + "view_7": 383, + "linear_10": 386, + "linear_11": 384, + "cat_2": 393, + "slice_18": 328, + "squeeze_1": 388, + "unsqueeze_5": 391, + "conv1d_1": 394, + "slice_19": 393, + "silu_3": 394, + "slice_20": 392, + "transpose_17": 391, + "slice_21": 388, + "slice_22": 392, + "slice_23": 393, + "view_8": 391, + "view_9": 388, + "view_10": 392, + "sigmoid_1": 393, + "exp_1": 386, + "neg_1": 394, + "add_12": 386, + "softplus_1": 384, + "mul_17": 386, + "mul_18": 384, + "sum_3": 394, + "add_13": 384, + "rsqrt_6": 394, + "mul_19": 384, + "mul_20": 391, + "sum_4": 394, + "add_14": 391, + "rsqrt_7": 394, + "mul_21": 391, + "normalized_gated_delta_rule_1": 394, + "slice_24": 329, + "slice_25": 388, + "transpose_18": 384, + "clone_1": 386, + "view_11": 388, + "view_12": 384, + "mul_23": 386, + "mul_24": 383, + "view_13": 388, + "linear_12": 384, + "add_16": 386, + "mul_26": 383, + "type_as_3": 388, + "linear_13": 391, + "linear_14": 392, + "mul_27": 393, + "linear_15": 389, + "add_19": 384, + "mul_29": 383, + "type_as_4": 388, + "linear_16": 391, + "transpose_19": 392, + "linear_17": 386, + "view_14": 389, + "linear_18": 383, + "linear_19": 386, + "cat_3": 393, + "slice_26": 330, + "squeeze_2": 388, + "unsqueeze_6": 391, + "conv1d_2": 394, + "slice_27": 393, + "silu_6": 394, + "slice_28": 392, + "transpose_20": 391, + "slice_29": 388, + "slice_30": 392, + "slice_31": 393, + "view_15": 391, + "view_16": 388, + "view_17": 392, + "sigmoid_2": 393, + "exp_2": 383, + "neg_2": 394, + "add_22": 383, + "softplus_2": 386, + "mul_30": 383, + "mul_31": 386, + "sum_5": 394, + "add_23": 386, + "rsqrt_11": 394, + "mul_32": 386, + "mul_33": 391, + "sum_6": 394, + "add_24": 391, + "rsqrt_12": 394, + "mul_34": 391, + "normalized_gated_delta_rule_2": 394, + "slice_32": 331, + "slice_33": 388, + "transpose_21": 386, + "clone_2": 383, + "view_18": 388, + "view_19": 386, + "mul_36": 383, + "mul_37": 389, + "view_20": 388, + "linear_20": 386, + "add_26": 383, + "mul_39": 389, + "type_as_5": 388, + "linear_21": 391, + "linear_22": 392, + "mul_40": 393, + "linear_23": 384, + "add_29": 386, + "mul_42": 389, + "type_as_6": 388, + "linear_24": 391, + "view_21": 392, + "slice_34": 383, + "slice_35": 384, + "clone_3": 389, + "_unsafe_view": 384, + "view_22": 389, + "mul_44": 383, + "type_as_7": 389, + "transpose_22": 383, + "linear_25": 389, + "view_23": 391, + "mul_46": 389, + "type_as_8": 392, + "transpose_23": 389, + "linear_26": 391, + "view_24": 388, + "transpose_24": 392, + "unsqueeze_7": 388, + "unsqueeze_8": 391, + "slice_36": 393, + "slice_37": 394, + "slice_38": 383, + "slice_39": 395, + "mul_47": 389, + "slice_40": 396, + "slice_41": 397, + "neg_3": 393, + "cat_4": 398, + "mul_48": 393, + "add_36": 398, + "mul_49": 397, + "slice_42": 396, + "slice_43": 389, + "neg_4": 388, + "cat_5": 383, + "mul_50": 396, + "add_37": 389, + "cat_6": 388, + "cat_7": 398, + "cache_update": 332, + "cache_update_1": 333, + "unsqueeze_9": 399, + "expand_1": 400, + "clone_4": 401, + "_unsafe_view_1": 400, + "unsqueeze_10": 399, + "expand_2": 401, + "clone_5": 402, + "_unsafe_view_2": 401, + "transpose_25": 402, + "matmul_1": 399, + "mul_51": 400, + "add_38": 399, + "softmax": 402, + "matmul_2": 383, + "transpose_26": 389, + "clone_6": 388, + "view_25": 383, + "sigmoid_3": 389, + "mul_52": 388, + "linear_27": 384, + "add_39": 383, + "mul_54": 389, + "type_as_9": 388, + "linear_28": 391, + "linear_29": 392, + "mul_55": 393, + "linear_30": 386, + "add_42": 384, + "mul_57": 389, + "type_as_10": 388, + "linear_31": 391, + "transpose_27": 392, + "linear_32": 383, + "view_26": 386, + "linear_33": 397, + "linear_34": 396, + "cat_8": 393, + "slice_44": 334, + "squeeze_3": 395, + "unsqueeze_11": 398, + "conv1d_3": 394, + "slice_45": 393, + "silu_10": 394, + "slice_46": 391, + "transpose_28": 392, + "slice_47": 389, + "slice_48": 383, + "slice_49": 388, + "view_27": 391, + "view_28": 389, + "view_29": 383, + "sigmoid_4": 395, + "exp_3": 397, + "neg_5": 398, + "add_45": 397, + "softplus_3": 396, + "mul_58": 397, + "mul_59": 388, + "sum_7": 396, + "add_46": 398, + "rsqrt_20": 396, + "mul_60": 388, + "mul_61": 392, + "sum_8": 396, + "add_47": 398, + "rsqrt_21": 396, + "mul_62": 391, + "normalized_gated_delta_rule_3": 392, + "slice_50": 335, + "slice_51": 389, + "transpose_29": 388, + "clone_7": 383, + "view_30": 389, + "view_31": 388, + "mul_64": 383, + "mul_65": 386, + "view_32": 389, + "linear_35": 388, + "add_49": 383, + "mul_67": 386, + "type_as_11": 389, + "linear_36": 391, + "linear_37": 392, + "mul_68": 393, + "linear_38": 384, + "add_52": 388, + "mul_70": 386, + "type_as_12": 389, + "linear_39": 391, + "transpose_30": 392, + "linear_40": 383, + "view_33": 384, + "linear_41": 396, + "linear_42": 397, + "cat_9": 393, + "slice_52": 336, + "squeeze_4": 395, + "unsqueeze_12": 398, + "conv1d_4": 394, + "slice_53": 393, + "silu_13": 394, + "slice_54": 391, + "transpose_31": 392, + "slice_55": 386, + "slice_56": 383, + "slice_57": 389, + "view_34": 391, + "view_35": 386, + "view_36": 383, + "sigmoid_5": 395, + "exp_4": 396, + "neg_6": 398, + "add_55": 396, + "softplus_4": 397, + "mul_71": 396, + "mul_72": 389, + "sum_9": 397, + "add_56": 398, + "rsqrt_25": 397, + "mul_73": 389, + "mul_74": 392, + "sum_10": 397, + "add_57": 398, + "rsqrt_26": 397, + "mul_75": 391, + "normalized_gated_delta_rule_4": 392, + "slice_58": 337, + "slice_59": 386, + "transpose_32": 389, + "clone_8": 383, + "view_37": 386, + "view_38": 389, + "mul_77": 383, + "mul_78": 384, + "view_39": 386, + "linear_43": 389, + "add_59": 383, + "mul_80": 384, + "type_as_13": 386, + "linear_44": 391, + "linear_45": 392, + "mul_81": 393, + "linear_46": 388, + "add_62": 389, + "mul_83": 384, + "type_as_14": 386, + "linear_47": 391, + "transpose_33": 392, + "linear_48": 383, + "view_40": 388, + "linear_49": 397, + "linear_50": 396, + "cat_10": 393, + "slice_60": 338, + "squeeze_5": 395, + "unsqueeze_13": 398, + "conv1d_5": 394, + "slice_61": 393, + "silu_16": 394, + "slice_62": 391, + "transpose_34": 392, + "slice_63": 384, + "slice_64": 383, + "slice_65": 386, + "view_41": 391, + "view_42": 384, + "view_43": 383, + "sigmoid_6": 395, + "exp_5": 397, + "neg_7": 398, + "add_65": 397, + "softplus_5": 396, + "mul_84": 397, + "mul_85": 386, + "sum_11": 396, + "add_66": 398, + "rsqrt_30": 396, + "mul_86": 386, + "mul_87": 392, + "sum_12": 396, + "add_67": 398, + "rsqrt_31": 396, + "mul_88": 391, + "normalized_gated_delta_rule_5": 392, + "slice_66": 339, + "slice_67": 384, + "transpose_35": 386, + "clone_9": 383, + "view_44": 384, + "view_45": 386, + "mul_90": 383, + "mul_91": 388, + "view_46": 384, + "linear_51": 386, + "add_69": 383, + "mul_93": 388, + "type_as_15": 384, + "linear_52": 391, + "linear_53": 392, + "mul_94": 393, + "linear_54": 389, + "add_72": 386, + "mul_96": 388, + "type_as_16": 384, + "linear_55": 391, + "view_47": 392, + "slice_68": 383, + "slice_69": 389, + "clone_10": 388, + "_unsafe_view_3": 389, + "view_48": 388, + "mul_98": 383, + "type_as_17": 388, + "transpose_36": 383, + "linear_56": 398, + "view_49": 388, + "mul_100": 398, + "type_as_18": 388, + "transpose_37": 398, + "linear_57": 388, + "view_50": 384, + "transpose_38": 388, + "unsqueeze_14": 396, + "unsqueeze_15": 397, + "slice_70": 384, + "slice_71": 391, + "slice_72": 395, + "slice_73": 383, + "mul_101": 398, + "slice_74": 392, + "slice_75": 393, + "neg_8": 384, + "cat_11": 393, + "mul_102": 384, + "add_79": 392, + "mul_103": 398, + "slice_76": 396, + "slice_77": 384, + "neg_9": 395, + "cat_12": 384, + "mul_104": 396, + "add_80": 397, + "cat_13": 384, + "cat_14": 398, + "cache_update_2": 340, + "cache_update_3": 341, + "unsqueeze_16": 399, + "expand_3": 400, + "clone_11": 402, + "_unsafe_view_4": 401, + "unsqueeze_17": 399, + "expand_4": 400, + "clone_12": 402, + "_unsafe_view_5": 400, + "transpose_39": 402, + "matmul_3": 399, + "mul_105": 401, + "add_81": 399, + "softmax_1": 402, + "matmul_4": 383, + "transpose_40": 388, + "clone_13": 384, + "view_51": 383, + "sigmoid_7": 388, + "mul_106": 384, + "linear_58": 389, + "add_82": 383, + "mul_108": 388, + "type_as_19": 384, + "linear_59": 392, + "linear_60": 391, + "mul_109": 393, + "linear_61": 386, + "add_85": 389, + "mul_111": 388, + "type_as_20": 384, + "linear_62": 392, + "transpose_41": 391, + "linear_63": 383, + "view_52": 386, + "linear_64": 396, + "linear_65": 397, + "cat_15": 393, + "slice_78": 342, + "squeeze_6": 395, + "unsqueeze_18": 398, + "conv1d_6": 394, + "slice_79": 393, + "silu_20": 394, + "slice_80": 392, + "transpose_42": 391, + "slice_81": 388, + "slice_82": 383, + "slice_83": 384, + "view_53": 392, + "view_54": 388, + "view_55": 383, + "sigmoid_8": 395, + "exp_6": 396, + "neg_10": 398, + "add_88": 396, + "softplus_6": 397, + "mul_112": 396, + "mul_113": 384, + "sum_13": 397, + "add_89": 398, + "rsqrt_39": 397, + "mul_114": 384, + "mul_115": 391, + "sum_14": 397, + "add_90": 398, + "rsqrt_40": 397, + "mul_116": 392, + "normalized_gated_delta_rule_6": 391, + "slice_84": 343, + "slice_85": 388, + "transpose_43": 384, + "clone_14": 383, + "view_56": 388, + "view_57": 384, + "mul_118": 383, + "mul_119": 386, + "view_58": 388, + "linear_66": 384, + "add_92": 383, + "mul_121": 386, + "type_as_21": 388, + "linear_67": 392, + "linear_68": 391, + "mul_122": 393, + "linear_69": 389, + "add_95": 384, + "mul_124": 386, + "type_as_22": 388, + "linear_70": 392, + "transpose_44": 391, + "linear_71": 383, + "view_59": 389, + "linear_72": 397, + "linear_73": 396, + "cat_16": 393, + "slice_86": 344, + "squeeze_7": 395, + "unsqueeze_19": 398, + "conv1d_7": 394, + "slice_87": 393, + "silu_23": 394, + "slice_88": 392, + "transpose_45": 391, + "slice_89": 386, + "slice_90": 383, + "slice_91": 388, + "view_60": 392, + "view_61": 386, + "view_62": 383, + "sigmoid_9": 395, + "exp_7": 397, + "neg_11": 398, + "add_98": 397, + "softplus_7": 396, + "mul_125": 397, + "mul_126": 388, + "sum_15": 396, + "add_99": 398, + "rsqrt_44": 396, + "mul_127": 388, + "mul_128": 391, + "sum_16": 396, + "add_100": 398, + "rsqrt_45": 396, + "mul_129": 392, + "normalized_gated_delta_rule_7": 391, + "slice_92": 345, + "slice_93": 386, + "transpose_46": 388, + "clone_15": 383, + "view_63": 386, + "view_64": 388, + "mul_131": 383, + "mul_132": 389, + "view_65": 386, + "linear_74": 388, + "add_102": 383, + "mul_134": 389, + "type_as_23": 386, + "linear_75": 392, + "linear_76": 391, + "mul_135": 393, + "linear_77": 384, + "add_105": 388, + "mul_137": 389, + "type_as_24": 386, + "linear_78": 392, + "transpose_47": 391, + "linear_79": 383, + "view_66": 384, + "linear_80": 396, + "linear_81": 397, + "cat_17": 393, + "slice_94": 346, + "squeeze_8": 395, + "unsqueeze_20": 398, + "conv1d_8": 394, + "slice_95": 393, + "silu_26": 394, + "slice_96": 392, + "transpose_48": 391, + "slice_97": 389, + "slice_98": 383, + "slice_99": 386, + "view_67": 392, + "view_68": 389, + "view_69": 383, + "sigmoid_10": 395, + "exp_8": 396, + "neg_12": 398, + "add_108": 396, + "softplus_8": 397, + "mul_138": 396, + "mul_139": 386, + "sum_17": 397, + "add_109": 398, + "rsqrt_49": 397, + "mul_140": 386, + "mul_141": 391, + "sum_18": 397, + "add_110": 398, + "rsqrt_50": 397, + "mul_142": 392, + "normalized_gated_delta_rule_8": 391, + "slice_100": 347, + "slice_101": 389, + "transpose_49": 386, + "clone_16": 383, + "view_70": 389, + "view_71": 386, + "mul_144": 383, + "mul_145": 384, + "view_72": 389, + "linear_82": 386, + "add_112": 383, + "mul_147": 384, + "type_as_25": 389, + "linear_83": 392, + "linear_84": 391, + "mul_148": 393, + "linear_85": 388, + "add_115": 386, + "mul_150": 384, + "type_as_26": 389, + "linear_86": 392, + "view_73": 391, + "slice_102": 383, + "slice_103": 388, + "clone_17": 384, + "_unsafe_view_6": 388, + "view_74": 384, + "mul_152": 383, + "type_as_27": 384, + "transpose_50": 383, + "linear_87": 398, + "view_75": 384, + "mul_154": 398, + "type_as_28": 384, + "transpose_51": 398, + "linear_88": 384, + "view_76": 389, + "transpose_52": 384, + "unsqueeze_21": 397, + "unsqueeze_22": 396, + "slice_104": 389, + "slice_105": 392, + "slice_106": 395, + "slice_107": 383, + "mul_155": 398, + "slice_108": 391, + "slice_109": 393, + "neg_13": 389, + "cat_18": 393, + "mul_156": 389, + "add_122": 391, + "mul_157": 398, + "slice_110": 397, + "slice_111": 389, + "neg_14": 395, + "cat_19": 389, + "mul_158": 397, + "add_123": 396, + "cat_20": 389, + "cat_21": 398, + "cache_update_4": 348, + "cache_update_5": 349, + "unsqueeze_23": 399, + "expand_5": 401, + "clone_18": 402, + "_unsafe_view_7": 400, + "unsqueeze_24": 399, + "expand_6": 401, + "clone_19": 402, + "_unsafe_view_8": 401, + "transpose_53": 402, + "matmul_5": 399, + "mul_159": 400, + "add_124": 399, + "softmax_2": 402, + "matmul_6": 383, + "transpose_54": 384, + "clone_20": 389, + "view_77": 383, + "sigmoid_11": 384, + "mul_160": 389, + "linear_89": 388, + "add_125": 383, + "mul_162": 384, + "type_as_29": 389, + "linear_90": 391, + "linear_91": 392, + "mul_163": 393, + "linear_92": 386, + "add_128": 388, + "mul_165": 384, + "type_as_30": 389, + "linear_93": 391, + "transpose_55": 392, + "linear_94": 383, + "view_78": 386, + "linear_95": 397, + "linear_96": 396, + "cat_22": 393, + "slice_112": 350, + "squeeze_9": 395, + "unsqueeze_25": 398, + "conv1d_9": 394, + "slice_113": 393, + "silu_30": 394, + "slice_114": 391, + "transpose_56": 392, + "slice_115": 384, + "slice_116": 383, + "slice_117": 389, + "view_79": 391, + "view_80": 384, + "view_81": 383, + "sigmoid_12": 395, + "exp_9": 397, + "neg_15": 398, + "add_131": 397, + "softplus_9": 396, + "mul_166": 397, + "mul_167": 389, + "sum_19": 396, + "add_132": 398, + "rsqrt_58": 396, + "mul_168": 389, + "mul_169": 392, + "sum_20": 396, + "add_133": 398, + "rsqrt_59": 396, + "mul_170": 391, + "normalized_gated_delta_rule_9": 392, + "slice_118": 351, + "slice_119": 384, + "transpose_57": 389, + "clone_21": 383, + "view_82": 384, + "view_83": 389, + "mul_172": 383, + "mul_173": 386, + "view_84": 384, + "linear_97": 389, + "add_135": 383, + "mul_175": 386, + "type_as_31": 384, + "linear_98": 391, + "linear_99": 392, + "mul_176": 393, + "linear_100": 388, + "add_138": 389, + "mul_178": 386, + "type_as_32": 384, + "linear_101": 391, + "transpose_58": 392, + "linear_102": 383, + "view_85": 388, + "linear_103": 396, + "linear_104": 397, + "cat_23": 393, + "slice_120": 352, + "squeeze_10": 395, + "unsqueeze_26": 398, + "conv1d_10": 394, + "slice_121": 393, + "silu_33": 394, + "slice_122": 391, + "transpose_59": 392, + "slice_123": 386, + "slice_124": 383, + "slice_125": 384, + "view_86": 391, + "view_87": 386, + "view_88": 383, + "sigmoid_13": 395, + "exp_10": 396, + "neg_16": 398, + "add_141": 396, + "softplus_10": 397, + "mul_179": 396, + "mul_180": 384, + "sum_21": 397, + "add_142": 398, + "rsqrt_63": 397, + "mul_181": 384, + "mul_182": 392, + "sum_22": 397, + "add_143": 398, + "rsqrt_64": 397, + "mul_183": 391, + "normalized_gated_delta_rule_10": 392, + "slice_126": 353, + "slice_127": 386, + "transpose_60": 384, + "clone_22": 383, + "view_89": 386, + "view_90": 384, + "mul_185": 383, + "mul_186": 388, + "view_91": 386, + "linear_105": 384, + "add_145": 383, + "mul_188": 388, + "type_as_33": 386, + "linear_106": 391, + "linear_107": 392, + "mul_189": 393, + "linear_108": 389, + "add_148": 384, + "mul_191": 388, + "type_as_34": 386, + "linear_109": 391, + "transpose_61": 392, + "linear_110": 383, + "view_92": 389, + "linear_111": 397, + "linear_112": 396, + "cat_24": 393, + "slice_128": 354, + "squeeze_11": 395, + "unsqueeze_27": 398, + "conv1d_11": 394, + "slice_129": 393, + "silu_36": 394, + "slice_130": 391, + "transpose_62": 392, + "slice_131": 388, + "slice_132": 383, + "slice_133": 386, + "view_93": 391, + "view_94": 388, + "view_95": 383, + "sigmoid_14": 395, + "exp_11": 397, + "neg_17": 398, + "add_151": 397, + "softplus_11": 396, + "mul_192": 397, + "mul_193": 386, + "sum_23": 396, + "add_152": 398, + "rsqrt_68": 396, + "mul_194": 386, + "mul_195": 392, + "sum_24": 396, + "add_153": 398, + "rsqrt_69": 396, + "mul_196": 391, + "normalized_gated_delta_rule_11": 392, + "slice_134": 355, + "slice_135": 388, + "transpose_63": 386, + "clone_23": 383, + "view_96": 388, + "view_97": 386, + "mul_198": 383, + "mul_199": 389, + "view_98": 388, + "linear_113": 386, + "add_155": 383, + "mul_201": 389, + "type_as_35": 388, + "linear_114": 391, + "linear_115": 392, + "mul_202": 393, + "linear_116": 384, + "add_158": 386, + "mul_204": 389, + "type_as_36": 388, + "linear_117": 391, + "view_99": 392, + "slice_136": 383, + "slice_137": 384, + "clone_24": 389, + "_unsafe_view_9": 384, + "view_100": 389, + "mul_206": 383, + "type_as_37": 389, + "transpose_64": 383, + "linear_118": 398, + "view_101": 389, + "mul_208": 398, + "type_as_38": 389, + "transpose_65": 398, + "linear_119": 389, + "view_102": 388, + "transpose_66": 389, + "unsqueeze_28": 396, + "unsqueeze_29": 397, + "slice_138": 388, + "slice_139": 391, + "slice_140": 395, + "slice_141": 383, + "mul_209": 398, + "slice_142": 392, + "slice_143": 393, + "neg_18": 388, + "cat_25": 393, + "mul_210": 388, + "add_165": 392, + "mul_211": 398, + "slice_144": 396, + "slice_145": 388, + "neg_19": 395, + "cat_26": 388, + "mul_212": 396, + "add_166": 397, + "cat_27": 388, + "cat_28": 398, + "cache_update_6": 356, + "cache_update_7": 357, + "unsqueeze_30": 399, + "expand_7": 400, + "clone_25": 402, + "_unsafe_view_10": 401, + "unsqueeze_31": 399, + "expand_8": 400, + "clone_26": 402, + "_unsafe_view_11": 400, + "transpose_67": 402, + "matmul_7": 399, + "mul_213": 401, + "add_167": 399, + "softmax_3": 402, + "matmul_8": 383, + "transpose_68": 389, + "clone_27": 388, + "view_103": 383, + "sigmoid_15": 389, + "mul_214": 388, + "linear_120": 384, + "add_168": 383, + "mul_216": 389, + "type_as_39": 388, + "linear_121": 392, + "linear_122": 391, + "mul_217": 393, + "linear_123": 386, + "add_171": 384, + "mul_219": 389, + "type_as_40": 388, + "linear_124": 392, + "transpose_69": 391, + "linear_125": 383, + "view_104": 386, + "linear_126": 396, + "linear_127": 397, + "cat_29": 393, + "slice_146": 358, + "squeeze_12": 395, + "unsqueeze_32": 398, + "conv1d_12": 394, + "slice_147": 393, + "silu_40": 394, + "slice_148": 392, + "transpose_70": 391, + "slice_149": 389, + "slice_150": 383, + "slice_151": 388, + "view_105": 392, + "view_106": 389, + "view_107": 383, + "sigmoid_16": 395, + "exp_12": 396, + "neg_20": 398, + "add_174": 396, + "softplus_12": 397, + "mul_220": 396, + "mul_221": 388, + "sum_25": 397, + "add_175": 398, + "rsqrt_77": 397, + "mul_222": 388, + "mul_223": 391, + "sum_26": 397, + "add_176": 398, + "rsqrt_78": 397, + "mul_224": 392, + "normalized_gated_delta_rule_12": 391, + "slice_152": 359, + "slice_153": 389, + "transpose_71": 388, + "clone_28": 383, + "view_108": 389, + "view_109": 388, + "mul_226": 383, + "mul_227": 386, + "view_110": 389, + "linear_128": 388, + "add_178": 383, + "mul_229": 386, + "type_as_41": 389, + "linear_129": 392, + "linear_130": 391, + "mul_230": 393, + "linear_131": 384, + "add_181": 388, + "mul_232": 386, + "type_as_42": 389, + "linear_132": 392, + "transpose_72": 391, + "linear_133": 383, + "view_111": 384, + "linear_134": 397, + "linear_135": 396, + "cat_30": 393, + "slice_154": 360, + "squeeze_13": 395, + "unsqueeze_33": 398, + "conv1d_13": 394, + "slice_155": 393, + "silu_43": 394, + "slice_156": 392, + "transpose_73": 391, + "slice_157": 386, + "slice_158": 383, + "slice_159": 389, + "view_112": 392, + "view_113": 386, + "view_114": 383, + "sigmoid_17": 395, + "exp_13": 397, + "neg_21": 398, + "add_184": 397, + "softplus_13": 396, + "mul_233": 397, + "mul_234": 389, + "sum_27": 396, + "add_185": 398, + "rsqrt_82": 396, + "mul_235": 389, + "mul_236": 391, + "sum_28": 396, + "add_186": 398, + "rsqrt_83": 396, + "mul_237": 392, + "normalized_gated_delta_rule_13": 391, + "slice_160": 361, + "slice_161": 386, + "transpose_74": 389, + "clone_29": 383, + "view_115": 386, + "view_116": 389, + "mul_239": 383, + "mul_240": 384, + "view_117": 386, + "linear_136": 389, + "add_188": 383, + "mul_242": 384, + "type_as_43": 386, + "linear_137": 392, + "linear_138": 391, + "mul_243": 393, + "linear_139": 388, + "add_191": 389, + "mul_245": 384, + "type_as_44": 386, + "linear_140": 392, + "transpose_75": 391, + "linear_141": 383, + "view_118": 388, + "linear_142": 396, + "linear_143": 397, + "cat_31": 393, + "slice_162": 362, + "squeeze_14": 395, + "unsqueeze_34": 398, + "conv1d_14": 394, + "slice_163": 393, + "silu_46": 394, + "slice_164": 392, + "transpose_76": 391, + "slice_165": 384, + "slice_166": 383, + "slice_167": 386, + "view_119": 392, + "view_120": 384, + "view_121": 383, + "sigmoid_18": 395, + "exp_14": 396, + "neg_22": 398, + "add_194": 396, + "softplus_14": 397, + "mul_246": 396, + "mul_247": 386, + "sum_29": 397, + "add_195": 398, + "rsqrt_87": 397, + "mul_248": 386, + "mul_249": 391, + "sum_30": 397, + "add_196": 398, + "rsqrt_88": 397, + "mul_250": 392, + "normalized_gated_delta_rule_14": 391, + "slice_168": 363, + "slice_169": 384, + "transpose_77": 386, + "clone_30": 383, + "view_122": 384, + "view_123": 386, + "mul_252": 383, + "mul_253": 388, + "view_124": 384, + "linear_144": 386, + "add_198": 383, + "mul_255": 388, + "type_as_45": 384, + "linear_145": 392, + "linear_146": 391, + "mul_256": 393, + "linear_147": 389, + "add_201": 386, + "mul_258": 388, + "type_as_46": 384, + "linear_148": 392, + "view_125": 391, + "slice_170": 383, + "slice_171": 389, + "clone_31": 388, + "_unsafe_view_12": 389, + "view_126": 388, + "mul_260": 383, + "type_as_47": 388, + "transpose_78": 383, + "linear_149": 398, + "view_127": 388, + "mul_262": 398, + "type_as_48": 388, + "transpose_79": 398, + "linear_150": 388, + "view_128": 384, + "transpose_80": 388, + "unsqueeze_35": 397, + "unsqueeze_36": 396, + "slice_172": 384, + "slice_173": 392, + "slice_174": 395, + "slice_175": 383, + "mul_263": 398, + "slice_176": 391, + "slice_177": 393, + "neg_23": 384, + "cat_32": 393, + "mul_264": 384, + "add_208": 391, + "mul_265": 398, + "slice_178": 397, + "slice_179": 384, + "neg_24": 395, + "cat_33": 384, + "mul_266": 397, + "add_209": 396, + "cat_34": 384, + "cat_35": 398, + "cache_update_8": 364, + "cache_update_9": 365, + "unsqueeze_37": 399, + "expand_9": 401, + "clone_32": 402, + "_unsafe_view_13": 400, + "unsqueeze_38": 399, + "expand_10": 401, + "clone_33": 402, + "_unsafe_view_14": 401, + "transpose_81": 402, + "matmul_9": 399, + "mul_267": 400, + "add_210": 399, + "softmax_4": 402, + "matmul_10": 383, + "transpose_82": 388, + "clone_34": 384, + "view_129": 383, + "sigmoid_19": 388, + "mul_268": 384, + "linear_151": 389, + "add_211": 383, + "mul_270": 388, + "type_as_49": 384, + "linear_152": 391, + "linear_153": 392, + "mul_271": 393, + "linear_154": 386, + "add_214": 389, + "mul_273": 388, + "type_as_50": 384, + "linear_155": 391, + "transpose_83": 392, + "linear_156": 383, + "view_130": 386, + "linear_157": 397, + "linear_158": 396, + "cat_36": 393, + "slice_180": 366, + "squeeze_15": 395, + "unsqueeze_39": 398, + "conv1d_15": 394, + "slice_181": 393, + "silu_50": 394, + "slice_182": 391, + "transpose_84": 392, + "slice_183": 388, + "slice_184": 383, + "slice_185": 384, + "view_131": 391, + "view_132": 388, + "view_133": 383, + "sigmoid_20": 395, + "exp_15": 397, + "neg_25": 398, + "add_217": 397, + "softplus_15": 396, + "mul_274": 397, + "mul_275": 384, + "sum_31": 396, + "add_218": 398, + "rsqrt_96": 396, + "mul_276": 384, + "mul_277": 392, + "sum_32": 396, + "add_219": 398, + "rsqrt_97": 396, + "mul_278": 391, + "normalized_gated_delta_rule_15": 392, + "slice_186": 367, + "slice_187": 388, + "transpose_85": 384, + "clone_35": 383, + "view_134": 388, + "view_135": 384, + "mul_280": 383, + "mul_281": 386, + "view_136": 388, + "linear_159": 384, + "add_221": 383, + "mul_283": 386, + "type_as_51": 388, + "linear_160": 391, + "linear_161": 392, + "mul_284": 393, + "linear_162": 389, + "add_224": 384, + "mul_286": 386, + "type_as_52": 388, + "linear_163": 391, + "transpose_86": 392, + "linear_164": 383, + "view_137": 389, + "linear_165": 396, + "linear_166": 397, + "cat_37": 393, + "slice_188": 368, + "squeeze_16": 395, + "unsqueeze_40": 398, + "conv1d_16": 394, + "slice_189": 393, + "silu_53": 394, + "slice_190": 391, + "transpose_87": 392, + "slice_191": 386, + "slice_192": 383, + "slice_193": 388, + "view_138": 391, + "view_139": 386, + "view_140": 383, + "sigmoid_21": 395, + "exp_16": 396, + "neg_26": 398, + "add_227": 396, + "softplus_16": 397, + "mul_287": 396, + "mul_288": 388, + "sum_33": 397, + "add_228": 398, + "rsqrt_101": 397, + "mul_289": 388, + "mul_290": 392, + "sum_34": 397, + "add_229": 398, + "rsqrt_102": 397, + "mul_291": 391, + "normalized_gated_delta_rule_16": 392, + "slice_194": 369, + "slice_195": 386, + "transpose_88": 388, + "clone_36": 383, + "view_141": 386, + "view_142": 388, + "mul_293": 383, + "mul_294": 389, + "view_143": 386, + "linear_167": 388, + "add_231": 383, + "mul_296": 389, + "type_as_53": 386, + "linear_168": 391, + "linear_169": 392, + "mul_297": 393, + "linear_170": 384, + "add_234": 388, + "mul_299": 389, + "type_as_54": 386, + "linear_171": 391, + "transpose_89": 392, + "linear_172": 383, + "view_144": 384, + "linear_173": 397, + "linear_174": 396, + "cat_38": 393, + "slice_196": 370, + "squeeze_17": 395, + "unsqueeze_41": 398, + "conv1d_17": 394, + "slice_197": 393, + "silu_56": 394, + "slice_198": 391, + "transpose_90": 392, + "slice_199": 389, + "slice_200": 383, + "slice_201": 386, + "view_145": 391, + "view_146": 389, + "view_147": 383, + "sigmoid_22": 395, + "exp_17": 397, + "neg_27": 398, + "add_237": 397, + "softplus_17": 396, + "mul_300": 397, + "mul_301": 386, + "sum_35": 396, + "add_238": 398, + "rsqrt_106": 396, + "mul_302": 386, + "mul_303": 392, + "sum_36": 396, + "add_239": 398, + "rsqrt_107": 396, + "mul_304": 391, + "normalized_gated_delta_rule_17": 392, + "slice_202": 371, + "slice_203": 389, + "transpose_91": 386, + "clone_37": 383, + "view_148": 389, + "view_149": 386, + "mul_306": 383, + "mul_307": 384, + "view_150": 389, + "linear_175": 386, + "add_241": 383, + "mul_309": 384, + "type_as_55": 389, + "linear_176": 391, + "linear_177": 392, + "mul_310": 393, + "linear_178": 388, + "add_244": 386, + "mul_312": 384, + "type_as_56": 389, + "linear_179": 391, + "view_151": 392, + "slice_204": 383, + "slice_205": 388, + "clone_38": 384, + "_unsafe_view_15": 388, + "view_152": 384, + "mul_314": 383, + "type_as_57": 384, + "transpose_92": 383, + "linear_180": 398, + "view_153": 384, + "mul_316": 398, + "type_as_58": 384, + "transpose_93": 398, + "linear_181": 384, + "view_154": 389, + "transpose_94": 384, + "unsqueeze_42": 396, + "unsqueeze_43": 397, + "slice_206": 389, + "slice_207": 387, + "slice_208": 395, + "slice_209": 385, + "mul_317": 398, + "slice_210": 383, + "slice_211": 391, + "neg_28": 389, + "cat_39": 392, + "mul_318": 389, + "add_251": 383, + "mul_319": 398, + "slice_212": 396, + "slice_213": 389, + "neg_29": 395, + "cat_40": 389, + "mul_320": 396, + "add_252": 397, + "cat_41": 389, + "cat_42": 398, + "cache_update_10": 372, + "cache_update_11": 373, + "unsqueeze_44": 399, + "expand_11": 400, + "clone_39": 402, + "_unsafe_view_16": 401, + "unsqueeze_45": 399, + "expand_12": 400, + "clone_40": 402, + "_unsafe_view_17": 400, + "transpose_95": 402, + "matmul_11": 399, + "mul_321": 401, + "add_253": 399, + "softmax_5": 402, + "matmul_12": 383, + "transpose_96": 387, + "clone_41": 385, + "view_155": 384, + "sigmoid_23": 389, + "mul_322": 383, + "linear_182": 387, + "add_254": 385, + "mul_324": 388, + "type_as_59": 384, + "linear_183": 391, + "linear_184": 392, + "mul_325": 393, + "linear_185": 389, + "add_257": 383, + "mul_327": 386, + "type_as_60": 387, + "alias": 388, + "linear_186__part_0": 399, + "linear_186__part_1": 401, + "linear_186__part_2": 402, + "linear_186__part_3": 400, + "linear_186__part_4": 403, + "linear_186__part_5": 404, + "linear_186__part_6": 405, + "linear_186__part_7": 406, + "linear_186__cat_0_0": 407, + "linear_186__cat_0_7": 399, + "linear_186": 408 + }, + "byteLength": 4160627840 + }, + "rewrites": [ + { + "pattern": "rms_norm", + "nodes": [ + "pow_1", + "mean", + "add", + "rsqrt", + "mul_2", + "add_1", + "mul_3" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_2", + "mean_1", + "add_5", + "rsqrt_3", + "mul_9", + "mul_10" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_3", + "mean_2", + "add_7", + "rsqrt_4", + "mul_12", + "add_8", + "mul_13" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_4", + "mean_3", + "add_10", + "rsqrt_5", + "mul_15", + "add_11", + "mul_16" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_5", + "mean_4", + "add_15", + "rsqrt_8", + "mul_22", + "mul_23" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_6", + "mean_5", + "add_17", + "rsqrt_9", + "mul_25", + "add_18", + "mul_26" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_7", + "mean_6", + "add_20", + "rsqrt_10", + "mul_28", + "add_21", + "mul_29" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_8", + "mean_7", + "add_25", + "rsqrt_13", + "mul_35", + "mul_36" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_9", + "mean_8", + "add_27", + "rsqrt_14", + "mul_38", + "add_28", + "mul_39" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_10", + "mean_9", + "add_30", + "rsqrt_15", + "mul_41", + "add_31", + "mul_42" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_11", + "mean_10", + "add_32", + "rsqrt_16", + "mul_43", + "add_33", + "mul_44" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_12", + "mean_11", + "add_34", + "rsqrt_17", + "mul_45", + "add_35", + "mul_46" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_13", + "mean_12", + "add_40", + "rsqrt_18", + "mul_53", + "add_41", + "mul_54" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_14", + "mean_13", + "add_43", + "rsqrt_19", + "mul_56", + "add_44", + "mul_57" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_15", + "mean_14", + "add_48", + "rsqrt_22", + "mul_63", + "mul_64" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_16", + "mean_15", + "add_50", + "rsqrt_23", + "mul_66", + "add_51", + "mul_67" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_17", + "mean_16", + "add_53", + "rsqrt_24", + "mul_69", + "add_54", + "mul_70" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_18", + "mean_17", + "add_58", + "rsqrt_27", + "mul_76", + "mul_77" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_19", + "mean_18", + "add_60", + "rsqrt_28", + "mul_79", + "add_61", + "mul_80" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_20", + "mean_19", + "add_63", + "rsqrt_29", + "mul_82", + "add_64", + "mul_83" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_21", + "mean_20", + "add_68", + "rsqrt_32", + "mul_89", + "mul_90" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_22", + "mean_21", + "add_70", + "rsqrt_33", + "mul_92", + "add_71", + "mul_93" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_23", + "mean_22", + "add_73", + "rsqrt_34", + "mul_95", + "add_74", + "mul_96" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_24", + "mean_23", + "add_75", + "rsqrt_35", + "mul_97", + "add_76", + "mul_98" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_25", + "mean_24", + "add_77", + "rsqrt_36", + "mul_99", + "add_78", + "mul_100" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_26", + "mean_25", + "add_83", + "rsqrt_37", + "mul_107", + "add_84", + "mul_108" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_27", + "mean_26", + "add_86", + "rsqrt_38", + "mul_110", + "add_87", + "mul_111" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_28", + "mean_27", + "add_91", + "rsqrt_41", + "mul_117", + "mul_118" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_29", + "mean_28", + "add_93", + "rsqrt_42", + "mul_120", + "add_94", + "mul_121" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_30", + "mean_29", + "add_96", + "rsqrt_43", + "mul_123", + "add_97", + "mul_124" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_31", + "mean_30", + "add_101", + "rsqrt_46", + "mul_130", + "mul_131" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_32", + "mean_31", + "add_103", + "rsqrt_47", + "mul_133", + "add_104", + "mul_134" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_33", + "mean_32", + "add_106", + "rsqrt_48", + "mul_136", + "add_107", + "mul_137" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_34", + "mean_33", + "add_111", + "rsqrt_51", + "mul_143", + "mul_144" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_35", + "mean_34", + "add_113", + "rsqrt_52", + "mul_146", + "add_114", + "mul_147" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_36", + "mean_35", + "add_116", + "rsqrt_53", + "mul_149", + "add_117", + "mul_150" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_37", + "mean_36", + "add_118", + "rsqrt_54", + "mul_151", + "add_119", + "mul_152" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_38", + "mean_37", + "add_120", + "rsqrt_55", + "mul_153", + "add_121", + "mul_154" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_39", + "mean_38", + "add_126", + "rsqrt_56", + "mul_161", + "add_127", + "mul_162" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_40", + "mean_39", + "add_129", + "rsqrt_57", + "mul_164", + "add_130", + "mul_165" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_41", + "mean_40", + "add_134", + "rsqrt_60", + "mul_171", + "mul_172" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_42", + "mean_41", + "add_136", + "rsqrt_61", + "mul_174", + "add_137", + "mul_175" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_43", + "mean_42", + "add_139", + "rsqrt_62", + "mul_177", + "add_140", + "mul_178" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_44", + "mean_43", + "add_144", + "rsqrt_65", + "mul_184", + "mul_185" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_45", + "mean_44", + "add_146", + "rsqrt_66", + "mul_187", + "add_147", + "mul_188" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_46", + "mean_45", + "add_149", + "rsqrt_67", + "mul_190", + "add_150", + "mul_191" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_47", + "mean_46", + "add_154", + "rsqrt_70", + "mul_197", + "mul_198" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_48", + "mean_47", + "add_156", + "rsqrt_71", + "mul_200", + "add_157", + "mul_201" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_49", + "mean_48", + "add_159", + "rsqrt_72", + "mul_203", + "add_160", + "mul_204" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_50", + "mean_49", + "add_161", + "rsqrt_73", + "mul_205", + "add_162", + "mul_206" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_51", + "mean_50", + "add_163", + "rsqrt_74", + "mul_207", + "add_164", + "mul_208" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_52", + "mean_51", + "add_169", + "rsqrt_75", + "mul_215", + "add_170", + "mul_216" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_53", + "mean_52", + "add_172", + "rsqrt_76", + "mul_218", + "add_173", + "mul_219" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_54", + "mean_53", + "add_177", + "rsqrt_79", + "mul_225", + "mul_226" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_55", + "mean_54", + "add_179", + "rsqrt_80", + "mul_228", + "add_180", + "mul_229" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_56", + "mean_55", + "add_182", + "rsqrt_81", + "mul_231", + "add_183", + "mul_232" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_57", + "mean_56", + "add_187", + "rsqrt_84", + "mul_238", + "mul_239" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_58", + "mean_57", + "add_189", + "rsqrt_85", + "mul_241", + "add_190", + "mul_242" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_59", + "mean_58", + "add_192", + "rsqrt_86", + "mul_244", + "add_193", + "mul_245" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_60", + "mean_59", + "add_197", + "rsqrt_89", + "mul_251", + "mul_252" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_61", + "mean_60", + "add_199", + "rsqrt_90", + "mul_254", + "add_200", + "mul_255" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_62", + "mean_61", + "add_202", + "rsqrt_91", + "mul_257", + "add_203", + "mul_258" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_63", + "mean_62", + "add_204", + "rsqrt_92", + "mul_259", + "add_205", + "mul_260" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_64", + "mean_63", + "add_206", + "rsqrt_93", + "mul_261", + "add_207", + "mul_262" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_65", + "mean_64", + "add_212", + "rsqrt_94", + "mul_269", + "add_213", + "mul_270" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_66", + "mean_65", + "add_215", + "rsqrt_95", + "mul_272", + "add_216", + "mul_273" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_67", + "mean_66", + "add_220", + "rsqrt_98", + "mul_279", + "mul_280" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_68", + "mean_67", + "add_222", + "rsqrt_99", + "mul_282", + "add_223", + "mul_283" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_69", + "mean_68", + "add_225", + "rsqrt_100", + "mul_285", + "add_226", + "mul_286" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_70", + "mean_69", + "add_230", + "rsqrt_103", + "mul_292", + "mul_293" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_71", + "mean_70", + "add_232", + "rsqrt_104", + "mul_295", + "add_233", + "mul_296" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_72", + "mean_71", + "add_235", + "rsqrt_105", + "mul_298", + "add_236", + "mul_299" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_73", + "mean_72", + "add_240", + "rsqrt_108", + "mul_305", + "mul_306" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_74", + "mean_73", + "add_242", + "rsqrt_109", + "mul_308", + "add_243", + "mul_309" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_75", + "mean_74", + "add_245", + "rsqrt_110", + "mul_311", + "add_246", + "mul_312" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_76", + "mean_75", + "add_247", + "rsqrt_111", + "mul_313", + "add_248", + "mul_314" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_77", + "mean_76", + "add_249", + "rsqrt_112", + "mul_315", + "add_250", + "mul_316" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_78", + "mean_77", + "add_255", + "rsqrt_113", + "mul_323", + "add_256", + "mul_324" + ] + }, + { + "pattern": "rms_norm", + "nodes": [ + "pow_79", + "mean_78", + "add_258", + "rsqrt_114", + "mul_326", + "add_259", + "mul_327" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_1", + "mul_11" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_2", + "mul_14" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_4", + "mul_24" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_5", + "mul_27" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_7", + "mul_37" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_8", + "mul_40" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_9", + "mul_55" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_11", + "mul_65" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_12", + "mul_68" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_14", + "mul_78" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_15", + "mul_81" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_17", + "mul_91" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_18", + "mul_94" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_19", + "mul_109" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_21", + "mul_119" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_22", + "mul_122" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_24", + "mul_132" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_25", + "mul_135" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_27", + "mul_145" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_28", + "mul_148" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_29", + "mul_163" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_31", + "mul_173" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_32", + "mul_176" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_34", + "mul_186" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_35", + "mul_189" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_37", + "mul_199" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_38", + "mul_202" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_39", + "mul_217" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_41", + "mul_227" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_42", + "mul_230" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_44", + "mul_240" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_45", + "mul_243" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_47", + "mul_253" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_48", + "mul_256" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_49", + "mul_271" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_51", + "mul_281" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_52", + "mul_284" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_54", + "mul_294" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_55", + "mul_297" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_57", + "mul_307" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_58", + "mul_310" + ] + }, + { + "pattern": "silu_mul", + "nodes": [ + "silu_59", + "mul_325" + ] + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_10" + ], + "input": "states_0", + "output": "slice_10", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_16" + ], + "input": "states_1", + "output": "slice_16", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_18" + ], + "input": "states_2", + "output": "slice_18", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_24" + ], + "input": "states_3", + "output": "slice_24", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_26" + ], + "input": "states_4", + "output": "slice_26", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_32" + ], + "input": "states_5", + "output": "slice_32", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_44" + ], + "input": "states_8", + "output": "slice_44", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_50" + ], + "input": "states_9", + "output": "slice_50", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_52" + ], + "input": "states_10", + "output": "slice_52", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_58" + ], + "input": "states_11", + "output": "slice_58", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_60" + ], + "input": "states_12", + "output": "slice_60", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_66" + ], + "input": "states_13", + "output": "slice_66", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_78" + ], + "input": "states_16", + "output": "slice_78", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_84" + ], + "input": "states_17", + "output": "slice_84", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_86" + ], + "input": "states_18", + "output": "slice_86", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_92" + ], + "input": "states_19", + "output": "slice_92", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_94" + ], + "input": "states_20", + "output": "slice_94", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_100" + ], + "input": "states_21", + "output": "slice_100", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_112" + ], + "input": "states_24", + "output": "slice_112", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_118" + ], + "input": "states_25", + "output": "slice_118", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_120" + ], + "input": "states_26", + "output": "slice_120", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_126" + ], + "input": "states_27", + "output": "slice_126", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_128" + ], + "input": "states_28", + "output": "slice_128", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_134" + ], + "input": "states_29", + "output": "slice_134", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_146" + ], + "input": "states_32", + "output": "slice_146", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_152" + ], + "input": "states_33", + "output": "slice_152", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_154" + ], + "input": "states_34", + "output": "slice_154", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_160" + ], + "input": "states_35", + "output": "slice_160", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_162" + ], + "input": "states_36", + "output": "slice_162", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_168" + ], + "input": "states_37", + "output": "slice_168", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_180" + ], + "input": "states_40", + "output": "slice_180", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_186" + ], + "input": "states_41", + "output": "slice_186", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_188" + ], + "input": "states_42", + "output": "slice_188", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_194" + ], + "input": "states_43", + "output": "slice_194", + "kind": "recurrent" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_196" + ], + "input": "states_44", + "output": "slice_196", + "kind": "convolution" + }, + { + "pattern": "dead_state_output_alias", + "nodes": [ + "slice_202" + ], + "input": "states_45", + "output": "slice_202", + "kind": "recurrent" + } + ], + "partitions": [ + { + "node": "embedding", + "weight": "p_model_model_language_model_embed_tokens_weight", + "rowsPerShard": 32768, + "bindingLimitBytes": 134217728 + }, + { + "node": "linear_186", + "weight": "p_model_model_language_model_embed_tokens_weight", + "rowsPerShard": 32768, + "bindingLimitBytes": 134217728 + } + ] +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/graph.json b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/graph.json new file mode 100644 index 0000000000000000000000000000000000000000..6ac2fac7787eed508ccb424bfb22cfb1fc43d5c1 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/graph.json @@ -0,0 +1,3 @@ +version https://git-lfs.github.com/spec/v1 +oid sha256:08ab0817bf450a7aa9e46b398e3acefdb387da69f292ac7c44f4577e3cb01bba +size 10685246 diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a0d5268212599675490c8bf45f22a240ac7aeb17 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0112d93bb1aa347d8887ce1b95610a1a21fc8450ff8f59bcd37747fa6bf6fa52.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3685c38c999329a75de1b14ae10134b4a83b8ff8 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0151a813c4a92adeb44f0e3b6108c77b29804118b588c9025805f724fce839b4.wgsl @@ -0,0 +1,24 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +var factor: f32; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.x + group.y * 128u; + if (row >= 128u) { return; } + let lane = local.x; + if (lane == 0u) { + var total = 0.0; + for (var j = 0u; j < 256u; j++) { + let v = f32(b0[row * 256u + j]); + total += v * v; + } + factor = inverseSqrt(total / 256.0 + 1e-06); + } + workgroupBarrier(); + for (var p = lane; p < 256u; p += 64u) { + let i = row * 256u + p; + out[i] = f32(f32(b0[row * 256u + p]) * factor * (f32(b1[p]) + 1.0)); + } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0169dcad370f1e983364b323dfec0c2afbd1857634efb0200e22ccc6b558d57e.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0169dcad370f1e983364b323dfec0c2afbd1857634efb0200e22ccc6b558d57e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e029a957ac6f8642d87eaf31b86149bef0358f63 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0169dcad370f1e983364b323dfec0c2afbd1857634efb0200e22ccc6b558d57e.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(select(f32(b0[i]), f32(b1[i]), f32(b2[((i / 2048u) % 16u) * 1u]) != 0.0)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0337d8a473b6e485bd383533df7d373dbbfe7a5f3a982424004560b7213fbaa3.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0337d8a473b6e485bd383533df7d373dbbfe7a5f3a982424004560b7213fbaa3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c50a7f2acd01b33468240fbe94eab2c802c81995 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0337d8a473b6e485bd383533df7d373dbbfe7a5f3a982424004560b7213fbaa3.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 4096u; +if (i >= 4096u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/04f26661cc9ac73bb7f39f66b76c4be31ee8774e094eeb41ed7d677e1b1d3fa9.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/04f26661cc9ac73bb7f39f66b76c4be31ee8774e094eeb41ed7d677e1b1d3fa9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..67133bd5fb075efe996a921acde0d02717ffa6f3 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/04f26661cc9ac73bb7f39f66b76c4be31ee8774e094eeb41ed7d677e1b1d3fa9.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 10u) { return; } +out[i] = f32(b0[((i / 10u) % 1u) * 32u + ((i / 10u) % 1u) * 32u + (((i / 1u) % 10u) * 3u + 2u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..2c6541fe94d64690204bfe16ca3317d9d1fb5108 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/04f5cb70141e507d48bd44a76bfdf264a404a706e8a012502dce5a22ee75bab0.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 24576u + ((i / 4u) % 6144u) * 1u + ((i / 1u) % 4u) * 6144u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0554a443ecf6ead32fd2d58178b9ce3c592c89a09b3f63fa509ee947323bb497.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0554a443ecf6ead32fd2d58178b9ce3c592c89a09b3f63fa509ee947323bb497.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..586ebe23e7ab6f7d0ea3d4db2ae21148fc2ede1a --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0554a443ecf6ead32fd2d58178b9ce3c592c89a09b3f63fa509ee947323bb497.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +out[i] = f32(b0[((i / 128u) % 1u) * 512u + ((i / 64u) % 2u) * 256u + ((i / 64u) % 1u) * 256u + (((i / 1u) % 64u) * 1u + 0u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ee8c8a4cc0cdaea931261f0dc33dc98926ba77b5 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/06eecde176beab9ff488ad533f2f4513e09bc49a30c4358f9648076f619f9992.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +out[i] = f32(b0[((i / 2048u) % 3u) * 2048u + ((i / 2048u) % 1u) * 2048u + ((i / 64u) % 32u) * 1u + ((i / 1u) % 64u) * 32u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0725908abf78c022f86deb338a06779f6f1346ebfe54ff5a43ee6b9eeb93c972.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0725908abf78c022f86deb338a06779f6f1346ebfe54ff5a43ee6b9eeb93c972.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..71b292e22afb334a345d95567bc425387a266f55 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0725908abf78c022f86deb338a06779f6f1346ebfe54ff5a43ee6b9eeb93c972.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 44u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..aae8351dd54da00a71ffebf7e3c9ee6e67fcbfde --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/07cfabe2e2c2feff22a06c8296600e5ca21efb7444419f0a05e5ff6f48e0292d.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let x = f32(b0[i]); +out[i] = f32(-x); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0835fa80eaadb7c0e6d677e1fc622ad5dcedabb431e5d312f3b7aeb2252a7c7c.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0835fa80eaadb7c0e6d677e1fc622ad5dcedabb431e5d312f3b7aeb2252a7c7c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..91f740aa7006d14dca451533719861c5823ff016 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0835fa80eaadb7c0e6d677e1fc622ad5dcedabb431e5d312f3b7aeb2252a7c7c.wgsl @@ -0,0 +1,8 @@ +@group(0) @binding(0) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(0.0); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..d671cc16305ddbecbb23cd39809cff43b1852827 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/08390b1553d11820d1d96b10add657b92acb8d26cd9f11acab8f16777ecfc10a.wgsl @@ -0,0 +1,21 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 436224u; +if (i >= 436224u) { return; } +let batch = i / 436224u; +let channel = (i / 71u) % 6144u; +let group = channel / 1u; +var acc = 0.0; +for (var c = 0u; c < 1u; c++) { + for (var p = 0u; p < 4u; p++) { + let pos0 = i32((i / 1u) % 71u) * 1 + i32((p / 1u) % 4u) * 1 - 3; + if (pos0 >= 0 && pos0 < 68) { acc += f32(b0[batch * 417792u + (group * 1u + c) * 68u + u32(pos0) * 1u]) * f32(b1[(channel * 1u + c) * 4u + p]); } + } +} +out[i] = f32(acc + 0.0); + +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/087fe4a47ab2de93b999a0e519015c12450bf97fb81683d317c894b2bd555169.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/087fe4a47ab2de93b999a0e519015c12450bf97fb81683d317c894b2bd555169.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..c5d941a0024ec81692392a38547cae7d0c7adf89 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/087fe4a47ab2de93b999a0e519015c12450bf97fb81683d317c894b2bd555169.wgsl @@ -0,0 +1,12 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 993280u; +if (i >= 993280u) { return; } +let coord = (i / 1u) % 248320u; +if (coord >= 0u && coord < 229376u) { out[i] = f32(b0[(i / 248320u) * 229376u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 229376u && coord < 248320u) { out[i] = f32(b1[(i / 248320u) * 18944u + (coord - 229376u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..49a08ac343cccf84ad9ff97c0e9afb2e3f61c0a4 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/09ea34c2533b929bd309e2bcbcf6d27fa02c731d82276ba6425db85961ea121b.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let x = f32(b0[i]); +out[i] = f32(inverseSqrt(x)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0b8815b1efe176d55ab08530c0a9e1913cf6c9ef3e773c574843573d237cf196.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0b8815b1efe176d55ab08530c0a9e1913cf6c9ef3e773c574843573d237cf196.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..686ab91f45e66184b49d0f2e7429a2171e634bad --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0b8815b1efe176d55ab08530c0a9e1913cf6c9ef3e773c574843573d237cf196.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let x = f32(b0[i]); +out[i] = f32(sin(x)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..54d385f25c67cd568fe09262762d9a1904e683d6 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0bbd6a5e356c1205a61dc3580a3ff68d88b98a952a5692d66b56ded171d9fc56.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(f32(b0[i]) + (1e-06 * 1.0)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..29b5fc50bb132d2ebad8fbc34a147c39968c70ec --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0d1edb63bf4dc212d55f8a4c79a50e04c0d822bd9f6e193003e2071ba0d57d69.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 16384u + ((i / 2048u) % 4u) * 4096u + ((i / 256u) % 8u) * 512u + (((i / 1u) % 256u) * 1u + 256u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0d3892883d1532d173a7dbe85d9ab1daa87f0d9b4923a535b8d2003f24f9500c.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0d3892883d1532d173a7dbe85d9ab1daa87f0d9b4923a535b8d2003f24f9500c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..8520366c6db35027de02453b6c726e0fc678ab4f --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0d3892883d1532d173a7dbe85d9ab1daa87f0d9b4923a535b8d2003f24f9500c.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e5468583a1ba929483119c50d4be42a58aed4dde1e15cc231908ed7543d0b71.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e5468583a1ba929483119c50d4be42a58aed4dde1e15cc231908ed7543d0b71.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ade08a974329726324b1351190b859421467cb83 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e5468583a1ba929483119c50d4be42a58aed4dde1e15cc231908ed7543d0b71.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 512u; +if (i >= 512u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e5e44ae1adc5e11bf41b230e4ab1f93b5c0bd79b4f4e28e205d02cae01cebd0.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e5e44ae1adc5e11bf41b230e4ab1f93b5c0bd79b4f4e28e205d02cae01cebd0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3de8608f7a5283c1ccb45de6ed56bf18870523a3 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e5e44ae1adc5e11bf41b230e4ab1f93b5c0bd79b4f4e28e205d02cae01cebd0.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 196608 || token >= 229376) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 196608) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e9b6ee5f92769faaee5c746d1a3b936cdb7731f3f8e70cbf0a3fe96f6c8d921.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e9b6ee5f92769faaee5c746d1a3b936cdb7731f3f8e70cbf0a3fe96f6c8d921.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4f53d9e9c23631cf5a05331a915d782100def317 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0e9b6ee5f92769faaee5c746d1a3b936cdb7731f3f8e70cbf0a3fe96f6c8d921.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[((i / 1u) % 4096u) * 1u]) * 1.0)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0f466ed2664d77386f48afd19d8ab2734312bfd4f5f4d5b063d801a0b0a97cd9.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0f466ed2664d77386f48afd19d8ab2734312bfd4f5f4d5b063d801a0b0a97cd9.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a4fdbfd039369e36f1cdc9eba26852986c005d38 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0f466ed2664d77386f48afd19d8ab2734312bfd4f5f4d5b063d801a0b0a97cd9.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(b0[((i / 2048u) % 1u) * 2048u + ((i / 128u) % 16u) * 128u + ((i / 128u) % 1u) * 2048u + ((i / 1u) % 128u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..15c550b1f32e4f6bb9a861ae384749b50592bd5d --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0f943f386d2f37a8e56b4285b26e1c093c2f2fa2a5ce81cc43c44cc9bb0137f5.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 384u; +if (i >= 384u) { return; } +out[i] = f32(b0[((i / 128u) % 3u) * 128u + ((i / 128u) % 1u) * 128u + ((i / 32u) % 4u) * 1u + ((i / 1u) % 32u) * 4u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fa78dd7a41f9816e0a051fa3076f0ee2d258ff73d4e66a1360a492cb2e924d6.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fa78dd7a41f9816e0a051fa3076f0ee2d258ff73d4e66a1360a492cb2e924d6.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5266b75614dc4adcdf1054f95d634f27f555bf5e --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fa78dd7a41f9816e0a051fa3076f0ee2d258ff73d4e66a1360a492cb2e924d6.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 163840 || token >= 196608) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 163840) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..43d5bb662e9175428e6b81bc2f0e2980727497a7 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fbc9484ef8ca703ced4ffd123f1ae733c44556b6cb160ee803b820ff5ec867d.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) * f32(b1[((i / 64u) % 16u) * 64u + ((i / 1u) % 64u) * 1u])); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..3ea41f6d3eb83d617fe82400dad88790e219d623 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/0fefc91d22c22107d86016f4e3cfc985d4fdcd2ce497d95a01a3c8690ad192fc.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 16u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 16u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 16u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/100cfb630383828acba947e4a98fa4a47e8173e7ca32a62325780b90606093bf.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/100cfb630383828acba947e4a98fa4a47e8173e7ca32a62325780b90606093bf.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e3642bd973561dea347a535f00a328f5dae3e1ab --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/100cfb630383828acba947e4a98fa4a47e8173e7ca32a62325780b90606093bf.wgsl @@ -0,0 +1,25 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var partial: array; +@compute @workgroup_size(64) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let i = group.x + group.y * 4096u; + if (i >= 4096u) { return; } + let lane = local.x; + var acc = 0.0; + for (var p = lane; p < 2048u; p += 64u) { acc += f32(b0[(i / 4096u) * 2048u + p]) * unpack_bf16_1((i % 4096u) * 2048u + p); } + partial[lane] = acc; + workgroupBarrier(); + for (var stride = 32u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[i] = f32(partial[0] + 0.0); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..734ca6d310d814721ab1e6528bfb950390679b49 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/102e16522e6813b67da08088e5c9aabd74f38b88966b812c0bd00cb90da50780.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 16u + row) * 32768u + col; + var acc = 0.0; + for (var tile = 0u; tile < 2048u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 16u && tile + local.x < 2048u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 16u + row) * 2048u + tile + local.x]); } + if (group.x * 8u + local.y < 32768u && tile + local.x < 2048u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 2048u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 16u && col < 32768u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/11a92e9cba6bfc381c98c5127db137639d6c87f1cb220459880ead039dc81256.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/11a92e9cba6bfc381c98c5127db137639d6c87f1cb220459880ead039dc81256.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..34af207bc7ce034721ed448af19bbd095c4bdb49 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/11a92e9cba6bfc381c98c5127db137639d6c87f1cb220459880ead039dc81256.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 12u) { return; } +out[i] = i32(b0[(((i / 4u) % 3u) * 1u + 1u) * 4u + ((i / 4u) % 1u) * 4u + ((i / 1u) % 4u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..fe72b9bbe1c94bc7406073ad754fa678e850e59d --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/121285fc94b4a9f873c60a1d6e0de9d764286607718405fd18288e7ff419c483.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 256u; +if (i >= 256u) { return; } +let x = f32(b0[i]); +if (x * 1.0 > 20.0) { out[i] = f32(x); return; } +out[i] = f32(log(1.0 + exp(x * 1.0)) / 1.0); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..6452ce1456ec5251372f66c853bffb54bd0465e4 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/12155d86d776e73f23d3bff0268c60dccb54c209ee9ee3a8cfd227ec4aa5b6df.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +out[i] = f32(b0[i]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1255847146b31732939e573cdb26c483358c1ce07f987bd8c3d3d69ae8c7e141.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1255847146b31732939e573cdb26c483358c1ce07f987bd8c3d3d69ae8c7e141.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..19ce143a6079d1d8518ef9ca512fcc3cdfe1205c --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1255847146b31732939e573cdb26c483358c1ce07f987bd8c3d3d69ae8c7e141.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 24576u; +if (i >= 24576u) { return; } +out[i] = f32(b0[((i / 24576u) % 1u) * 30720u + ((i / 4u) % 6144u) * 5u + (((i / 1u) % 4u) * 1u + 1u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/13237b557466d2fef5bfbc74e7ac77219b9821a53bc0843dbb5d14db8b04d414.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/13237b557466d2fef5bfbc74e7ac77219b9821a53bc0843dbb5d14db8b04d414.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b455658f02601c7cfd2493171e0ae0ce54e635a5 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/13237b557466d2fef5bfbc74e7ac77219b9821a53bc0843dbb5d14db8b04d414.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) * f32(b0[i])); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4977dd26d91c116b0df884dba3354bba5ff74661 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1326034f3abab37629cd88f869d1b0bafcde724f85c07904b54feaaf71d89c62.wgsl @@ -0,0 +1,44 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var b2: array; +@group(0) @binding(3) var b3: array; +@group(0) @binding(4) var b4: array; +@group(0) @binding(5) var b5: array; +@group(0) @binding(6) var out: array; + +var partial: array; +var delta: f32; +@compute @workgroup_size(128) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let column = group.x; + let head = group.y; + let batch_index = group.z; + let lane = local.x; + var recurrent = 0.0; + if (lane < 128u) { recurrent = f32(b5[((batch_index * 16u + head) * 128u + lane) * 128u + column]); } + for (var token = 0u; token < 4u; token++) { + recurrent *= exp(f32(b3[(batch_index * 4u + token) * 16u + head])); + partial[lane] = 0.0; + if (lane < 128u) { partial[lane] = recurrent * f32(b1[((batch_index * 4u + token) * 16u + head) * 128u + lane]); } + workgroupBarrier(); + for (var stride = 64u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { delta = (f32(b2[((batch_index * 4u + token) * 16u + head) * 128u + column]) - partial[0]) * f32(b4[(batch_index * 4u + token) * 16u + head]); } + workgroupBarrier(); + if (lane < 128u) { recurrent += f32(b1[((batch_index * 4u + token) * 16u + head) * 128u + lane]) * delta; } + partial[lane] = 0.0; + if (lane < 128u) { + partial[lane] = recurrent * f32(b0[((batch_index * 4u + token) * 16u + head) * 128u + lane]) * 0.08838834764831845; + } + workgroupBarrier(); + for (var stride = 64u; stride > 0u; stride /= 2u) { + if (lane < stride) { partial[lane] += partial[lane + stride]; } + workgroupBarrier(); + } + if (lane == 0u) { out[((batch_index * 16u + head) * 132u + 128u + token) * 128u + column] = f32(partial[0]); } + workgroupBarrier(); + } + if (lane < 128u) { out[((batch_index * 16u + head) * 132u + lane) * 128u + column] = f32(recurrent); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/13dc73935b9b3b978232043e13babee3877bd53ca572be440de0590dacce8b17.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/13dc73935b9b3b978232043e13babee3877bd53ca572be440de0590dacce8b17.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..de89efb15b0a288331488e51bd02760c3dded87f --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/13dc73935b9b3b978232043e13babee3877bd53ca572be440de0590dacce8b17.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 32u) { return; } +out[i] = f32(b0[0u * 32u + ((i / 32u) % 1u) * 32u + ((i / 32u) % 1u) * 32u + ((i / 1u) % 32u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1545025e0a625ccc73b42ae112c6f9d78a1504c10b759979ae2247984f25f056.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1545025e0a625ccc73b42ae112c6f9d78a1504c10b759979ae2247984f25f056.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..94be53f6bd2811f15de48160517e54acd7fde791 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1545025e0a625ccc73b42ae112c6f9d78a1504c10b759979ae2247984f25f056.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +let coord = (i / 1u) % 32u; +if (coord >= 1u && coord < 34u && (coord - 1u) % 3u == 0u) { out[i] = f32(b0[((i / 128u) % 1u) * 44u + ((i / 32u) % 4u) * 11u + ((((i / 1u) % 32u) - 1u) / 3u) * 1u]); } else { out[i] = f32(b1[i]); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/17b972f97cc2659712ca7c658cd186e851a248115f83a893a8a11f34b441367e.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/17b972f97cc2659712ca7c658cd186e851a248115f83a893a8a11f34b441367e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..33a0f5c4f085cfd587f2df5a30d6a9ec79e95d0e --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/17b972f97cc2659712ca7c658cd186e851a248115f83a893a8a11f34b441367e.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 32768u; +if (i >= 32768u) { return; } +let token = i32(b0[i / 2048u]); +if (token < 32768 || token >= 65536) { out[i] = f32(0.0); return; } +out[i] = f32(unpack_bf16_1(u32(token - 32768) * 2048u + i % 2048u)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/17ec6bdaf98edf7657b74a25036c2bec806ecbb4280f33fff6afd2e0de5ed377.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/17ec6bdaf98edf7657b74a25036c2bec806ecbb4280f33fff6afd2e0de5ed377.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..f8b87c0bd2b9575bbbc8395e5d566f057aeb69dd --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/17ec6bdaf98edf7657b74a25036c2bec806ecbb4280f33fff6afd2e0de5ed377.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 2048u; +if (i >= 2048u) { return; } +out[i] = f32(f32(b0[i]) * 0.08838834764831843); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..4446cdc4e73df59c1bfe3b5230a9d873261c1cd9 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/18a0b02a12ebf73203283d267342582d54ba411aeee9cbe21ad89ae890e4cfea.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 8192u + ((i / 1024u) % 8u) * 256u + ((i / 256u) % 4u) * 2048u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..460942834da66dc168f11860dfbd38c9cd069806 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/18b1cef2bae996f56664d9215180e3bfc77b4e514db52fdf9b6c58be51b53edb.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 44u) { return; } +out[i] = f32(b0[((i / 44u) % 1u) * 128u + ((i / 11u) % 4u) * 32u + (((i / 1u) % 11u) * 3u + 1u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..b905fe9326d21b4a633e4e0d2d9e58073175e546 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/19311450ce50f80ef4c828a7ebd042a5012ed7a39e4310abec1f8b400c4a8821.wgsl @@ -0,0 +1,28 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; +fn unpack_bf16_1(index: u32) -> f32 { + let pair = b1[index / 2u]; + let bits = (pair >> ((index % 2u) * 16u)) & 65535u; + return bitcast(bits << 16u); +} + +var tile_a: array; +var tile_b: array; +@compute @workgroup_size(8, 8) +fn main(@builtin(workgroup_id) group: vec3, @builtin(local_invocation_id) local: vec3) { + let row = group.y * 8u + local.y; + let col = group.x * 8u + local.x; + let i = (group.z * 4u + row) * 2048u + col; + var acc = 0.0; + for (var tile = 0u; tile < 6144u; tile += 8u) { + tile_a[local.y * 8u + local.x] = 0.0; + tile_b[local.x * 8u + local.y] = 0.0; + if (row < 4u && tile + local.x < 6144u) { tile_a[local.y * 8u + local.x] = f32(b0[(group.z * 4u + row) * 6144u + tile + local.x]); } + if (group.x * 8u + local.y < 2048u && tile + local.x < 6144u) { tile_b[local.x * 8u + local.y] = unpack_bf16_1((group.x * 8u + local.y) * 6144u + tile + local.x); } + workgroupBarrier(); + for (var p = 0u; p < 8u; p++) { acc += tile_a[local.y * 8u + p] * tile_b[p * 8u + local.x]; } + workgroupBarrier(); + } + if (row < 4u && col < 2048u) { out[i] = f32(acc + 0.0); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..41fd5a021bacdb59aa4b8e651a7ca5fc0a5156ce --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/19564c145248f065669be23f5daeeda96e025ee4389bef80983001e83fddb31d.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +let x = f32(b0[i]); +if (x * 1.0 > 20.0) { out[i] = f32(x); return; } +out[i] = f32(log(1.0 + exp(x * 1.0)) / 1.0); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1a73b6fceda28f40bba4ae27a986ffa39842db94fa5903ea5bf689a7e854d4f3.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1a73b6fceda28f40bba4ae27a986ffa39842db94fa5903ea5bf689a7e854d4f3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..e2608a38a4a14347c0dd37068bb5040f9280ed0d --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1a73b6fceda28f40bba4ae27a986ffa39842db94fa5903ea5bf689a7e854d4f3.wgsl @@ -0,0 +1,11 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1024u; +if (i >= 1024u) { return; } +let coord = (i / 1u) % 64u; +if (coord >= 0u && coord < 32u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 0u) * 1u + i % 1u]); } +if (coord >= 32u && coord < 64u) { out[i] = f32(b0[(i / 64u) * 32u + (coord - 32u) * 1u + i % 1u]); } +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1ad205080cae29142a3ad87343a0cf3ac4945455398293946110d421ce6d515e.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1ad205080cae29142a3ad87343a0cf3ac4945455398293946110d421ce6d515e.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..04dc360880644481a17005996f0dece2fe491df3 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1ad205080cae29142a3ad87343a0cf3ac4945455398293946110d421ce6d515e.wgsl @@ -0,0 +1,10 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 128u; +if (i >= 128u) { return; } +out[i] = f32(f32(b0[i]) + (f32(b1[i]) * 1.0)); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1b9f4e330debc7235cfaf8f51d00fec575e09aa6116a45ea001e10ff5f09eb8c.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1b9f4e330debc7235cfaf8f51d00fec575e09aa6116a45ea001e10ff5f09eb8c.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..34861471bb74f5ed088ecba3565e1ccc71cad68f --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1b9f4e330debc7235cfaf8f51d00fec575e09aa6116a45ea001e10ff5f09eb8c.wgsl @@ -0,0 +1,17 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 1536u; +if (i >= 1536u) { return; } +let batch = i / 512u; +let row = (i / 16u) % 32u; +let col = i % 16u; +var acc = 0.0; +for (var p = 0u; p < 1u; p++) { + acc += f32(b0[(((batch / 1u) % 3u) * 32u) + row * 1u + p]) * f32(b1[(((batch / 1u) % 3u) * 16u) + p * 16u + col]); +} +out[i] = f32(acc); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..0c5bc84965c97bab5f1221cde0dd272918f11497 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1d0cbb068fe17123e646934bfa1259f19e5db04e45d72a157d3ea4fa48c81aa0.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 131072u; +if (i >= 131072u) { return; } +out[i] = f32(b0[((i / 131072u) % 1u) * 131072u + ((i / 16384u) % 8u) * 256u + ((i / 256u) % 64u) * 2048u + ((i / 1u) % 256u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..ba6aa45f32cb5f338b11181ce9264860b26e3463 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/1ea73621b5acbcc2acfe99cb1cefae97247ee2c199f0b0a8574815ea776ca3bb.wgsl @@ -0,0 +1,21 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var b1: array; +@group(0) @binding(2) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 141312u; +if (i >= 141312u) { return; } +let batch = i / 141312u; +let channel = (i / 23u) % 6144u; +let group = channel / 1u; +var acc = 0.0; +for (var c = 0u; c < 1u; c++) { + for (var p = 0u; p < 4u; p++) { + let pos0 = i32((i / 1u) % 23u) * 1 + i32((p / 1u) % 4u) * 1 - 3; + if (pos0 >= 0 && pos0 < 20) { acc += f32(b0[batch * 122880u + (group * 1u + c) * 20u + u32(pos0) * 1u]) * f32(b1[(channel * 1u + c) * 4u + p]); } + } +} +out[i] = f32(acc + 0.0); + +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1597f56a28fb2451f63cf7ddb5821f4054a6a2ac --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/20a4dee9cf34730b4ad77bde7921c189235c4da7d54a3dfb0d589f4d5275c755.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 8192u; +if (i >= 8192u) { return; } +out[i] = f32(b0[((i / 8192u) % 1u) * 24576u + ((i / 2048u) % 4u) * 6144u + (((i / 1u) % 2048u) * 1u + 4096u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/20fb9e0d0bd2aab34b7f69eac259898e68cac4a0d6b0bda5e95c9126a660336d.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/20fb9e0d0bd2aab34b7f69eac259898e68cac4a0d6b0bda5e95c9126a660336d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..5dc4ef605d0aeb8c1e6544aebe9f0ade791f4095 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/20fb9e0d0bd2aab34b7f69eac259898e68cac4a0d6b0bda5e95c9126a660336d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 64u) { return; } +out[i] = f32(b0[((i / 64u) % 1u) * 128u + ((i / 32u) % 2u) * 64u + ((i / 32u) % 1u) * 64u + (((i / 1u) % 32u) * 1u + 32u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..00f6bdb0636978dad1845f155968d9d353e76038 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/21041daa70434b3e73944fa280cd85a0ef190cf5e3e25fb0a642c486bb37d4de.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 524288u; +if (i >= 524288u) { return; } +out[i] = f32(f32(b0[i]) * 0.0625); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..a10282b1a7089bcbf3fc3c13bf9435b3d210d5c4 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/2182574f59b7d9e38d74b30540c5781827e7da2de1ba6b00327af0b4cb42379d.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 6144u; +if (i >= 6144u) { return; } +out[i] = f32(b0[((i / 6144u) % 1u) * 8192u + ((i / 3072u) % 2u) * 4096u + ((i / 192u) % 16u) * 256u + (((i / 1u) % 192u) * 1u + 64u) * 1u]); +} diff --git a/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/222a2645e3e02d0a4063a63ca1b6fa4c89faee6b76905b20de4dd54ab3077ea3.wgsl b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/222a2645e3e02d0a4063a63ca1b6fa4c89faee6b76905b20de4dd54ab3077ea3.wgsl new file mode 100644 index 0000000000000000000000000000000000000000..1447aa7dfa8f3765ba1ecc1e492c6fce42213779 --- /dev/null +++ b/qwen35-2b-multimodal-fp32-three-grid-state-alias-token-major-v2/kernels/222a2645e3e02d0a4063a63ca1b6fa4c89faee6b76905b20de4dd54ab3077ea3.wgsl @@ -0,0 +1,9 @@ +@group(0) @binding(0) var b0: array; +@group(0) @binding(1) var out: array; + +@compute @workgroup_size(64) +fn main(@builtin(global_invocation_id) gid: vec3) { +let i = gid.x + gid.y * 64u; +if (i >= 3u) { return; } +out[i] = f32(b0[i]); +}